Nghiên cứu
FrontierChallenge: Thử thách mới đánh giá khả năng thực hiện quy trình nghiên cứu khoa học của AI
(giờ Việt Nam)
Tóm tắt AI
FrontierChallenge là bộ tiêu chuẩn đánh giá mới với 300 quy trình khoa học đa lĩnh vực, cho thấy các mô hình AI hiện nay vẫn gặp khó khăn lớn khi chỉ hoàn thành khoảng 20% nhiệm vụ thực tế.
Bản dịch AI
Tác giả: Liangcai Su, Zhaopeng Feng, Zhuo Chen, Zhen Zhang, Xiang Lin, Ruilin Li, Handuo Zhang, Ning Wang, Kailong Wen, Yueqi Guo, Feng Xing, Yiling Guo, Chenxiong Qian, Simon Shaolei Du, Lidong Bing, Xinyu Wang
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Liangcai Su [xem email] [v1] Thứ Ba, 25 tháng 8 năm 2026 16:50:58 UTC (5,609 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.