Nghiên cứu
NeoHorse-1: Bước tiến về khả năng tự cải tiến đệ quy thông qua huấn luyện tác nhân có định tuyến
(giờ Việt Nam)
Tóm tắt AI
NeoHorse-1 giới thiệu phương pháp huấn luyện tác nhân mới, sử dụng hệ thống định tuyến thông minh để chuyển đổi dữ liệu tương tác thành các bài học tự cải tiến, giúp mô hình tối ưu hóa khả năng suy luận và sử dụng công cụ một cách tự động.
Bản dịch AI
Tác giả: Nhóm NeoHorse, Guoliang Cao, Guohao Dai, Tianyu Guo, Kai Han, Hailin Hu, Zihan Jiang, Xiang Kuang, Boxun Li, Yulong Li, Zehua Pei, Yuchuan Tian, Jiamin Wang, Yu Wang, Yunhe Wang, Yihong Wu, Haiyang Xu, Shuo Zhang, Hang Zhou, Siyang Cheng, Jiayu Fan, Wei He, Qingrui Jiao, Hongguang Li, Zhiyuan Li, Runke Liu, Xi Liu, Xinchen Liu, Sinno Jialin Pan, Yi Ren, Liuyang Song, Chenyu Wang, Bei Yu, Quanlu Zhang, Xiangyu Zhang, Mengyu Zheng, Yingjie Zong
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Zehua Pei [xem email] [v1] Thứ Ba, ngày 8 tháng 9 năm 2026 03:14:54 UTC (708 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.