Nghiên cứuĐiểm AI 85/100
Người mù sờ voi: Giải mã sự hạn chế tri thức của LLM đối với các dữ liệu hiếm và gây tranh cãi
Nghiên cứu giới thiệu ElephantBench, bộ dữ liệu gồm 1.094 câu hỏi để kiểm tra khả năng của LLM trong việc ghi nhớ các quan điểm trái chiều về những sự kiện ít phổ biến. Kết quả cho thấy ngay cả các mô hình mạnh nhất cũng thường bỏ sót các luồng thông tin khác nhau, cho thấy lỗ hổng trong tri thức của AI.