Nghiên cứu
Khả năng suy luận tài chính của LLM có đáng tin cậy? Kiểm chứng thực tế qua các báo cáo dài hạn
(giờ Việt Nam)
Tóm tắt AI
Nghiên cứu giới thiệu FinIndices, bộ tiêu chuẩn đánh giá khả năng xử lý dữ liệu tài chính phức tạp trên các báo cáo dài tới 32K token, nhằm vạch trần những lỗ hổng nghiêm trọng trong tư duy logic của các mô hình ngôn ngữ lớn hiện nay.
Bản dịch AI
Tác giả: Xinke Tong, Xuanming Zhang, Tianyi Tang, An Yang, Jiatu Hu, Guojie Lin, Zhenzhen Shi, Lingfeng Zeng, Boyu Yang, Bing Zhao, Hu Wei, Lin Qu, Dayiheng Liu
Xem PDF
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Xinke Tong [xem email] [v1] Thứ Tư, ngày 22 tháng 7 năm 2026 06:53:07 UTC (2,233 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.