Hugging Face Daily Papers
85

Nghiên cứu

Độ chính xác và sự nhạy cảm với thứ tự đáp án trong các mô hình ngôn ngữ lớn

(giờ Việt Nam)

Tóm tắt AI

Nghiên cứu chỉ ra rằng các bài kiểm tra trắc nghiệm thường bị nhiễu do thứ tự đáp án, và việc loại bỏ nhãn lựa chọn không giúp cải thiện độ chính xác thực tế của mô hình.

Bản dịch AI

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Karl Hanna [xem email] [v1] Thứ Tư, 12 tháng 8 năm 2026 11:34:45 UTC (77 KB)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.