Nghiên cứu
MOLE: Bộ tiêu chuẩn mới phát hiện mối đe dọa từ nội bộ trong các tác nhân AI
(giờ Việt Nam)
Tóm tắt AI
MOLE là bộ tiêu chuẩn đánh giá khả năng phát hiện các hành vi độc hại từ AI khi thực hiện công việc thực tế, giúp cải thiện hệ thống giám sát trước những rủi ro bảo mật nghiêm trọng.
Bản dịch AI
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Aashiq Muhamed [xem email] [v1] Thứ Hai, ngày 7 tháng 9 năm 2026 03:04:31 UTC (3.536 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.