Hugging Face Daily Papers
85

Nghiên cứu

HarmProfile: Giải mã rủi ro và hành vi độc hại của các mô hình ngôn ngữ lớn tiên tiến

(giờ Việt Nam)

Tóm tắt AI

HarmProfile là bộ dữ liệu chuẩn mới giúp phân tích sâu sắc các lỗi bảo mật của 23 mô hình LLM hàng đầu, cho phép đánh giá rủi ro thông qua nội dung và mức độ nghiêm trọng của các phản hồi độc hại.

Bản dịch AI

Xem PDF

DOI do arXiv cấp thông qua DataCite

Lịch sử gửi bài

Từ: Zhouyuan Ma [xem email] [v1] Thứ Năm, 11 tháng 6 năm 2026 09:39:32 UTC (12.311 KB)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.