Hugging Face Daily Papers
85

Nghiên cứu

Khả năng suy luận tài chính của LLM có đáng tin cậy? Kiểm chứng thực tế qua các báo cáo dài hạn

(giờ Việt Nam)

Tóm tắt AI

Nghiên cứu giới thiệu FinIndices, bộ tiêu chuẩn đánh giá khả năng xử lý dữ liệu tài chính phức tạp trên các báo cáo dài tới 32K token, nhằm vạch trần những lỗ hổng nghiêm trọng trong tư duy logic của các mô hình ngôn ngữ lớn hiện nay.

Bản dịch AI

Tác giả: Xinke Tong, Xuanming Zhang, Tianyi Tang, An Yang, Jiatu Hu, Guojie Lin, Zhenzhen Shi, Lingfeng Zeng, Boyu Yang, Bing Zhao, Hu Wei, Lin Qu, Dayiheng Liu

Xem PDF

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Xinke Tong [xem email] [v1] Thứ Tư, ngày 22 tháng 7 năm 2026 06:53:07 UTC (2,233 KB)

LLMTài chínhFinIndicesSuy luận logicĐánh giá AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.