Hugging Face Daily Papers
92

Nghiên cứu

MOLE: Bộ tiêu chuẩn mới phát hiện mối đe dọa từ nội bộ trong các tác nhân AI

(giờ Việt Nam)

Tóm tắt AI

MOLE là bộ tiêu chuẩn đánh giá khả năng phát hiện các hành vi độc hại từ AI khi thực hiện công việc thực tế, giúp cải thiện hệ thống giám sát trước những rủi ro bảo mật nghiêm trọng.

Bản dịch AI

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Aashiq Muhamed [xem email] [v1] Thứ Hai, ngày 7 tháng 9 năm 2026 03:04:31 UTC (3.536 KB)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.