Hugging Face Daily Papers
85

Nghiên cứu

FrontierChallenge: Thử thách mới đánh giá khả năng thực hiện quy trình nghiên cứu khoa học của AI

(giờ Việt Nam)

Tóm tắt AI

FrontierChallenge là bộ tiêu chuẩn đánh giá mới với 300 quy trình khoa học đa lĩnh vực, cho thấy các mô hình AI hiện nay vẫn gặp khó khăn lớn khi chỉ hoàn thành khoảng 20% nhiệm vụ thực tế.

Bản dịch AI

Tác giả: Liangcai Su, Zhaopeng Feng, Zhuo Chen, Zhen Zhang, Xiang Lin, Ruilin Li, Handuo Zhang, Ning Wang, Kailong Wen, Yueqi Guo, Feng Xing, Yiling Guo, Chenxiong Qian, Simon Shaolei Du, Lidong Bing, Xinyu Wang

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Liangcai Su [xem email] [v1] Thứ Ba, 25 tháng 8 năm 2026 16:50:58 UTC (5,609 KB)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.