Nghiên cứu
KoNA: Đánh giá khả năng từ chối trả lời thông minh của các mô hình thị giác - ngôn ngữ
(giờ Việt Nam)
Tóm tắt AI
Nghiên cứu giới thiệu KoNA, bộ tiêu chuẩn đánh giá khả năng nhận diện và từ chối trả lời các yêu cầu không an toàn, sai lệch hoặc bất khả thi ở cấp độ chi tiết thay vì chỉ đánh giá toàn bộ câu hỏi.
Bản dịch AI
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Minji Kim [xem email] [v1] Thứ Sáu, ngày 4 tháng 9 năm 2026 04:45:26 UTC (4.744 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.