Nghiên cứu
SWE-Bench ProMax: Chuẩn đánh giá AI mới cho khả năng tái cấu trúc mã nguồn đa ngôn ngữ
(giờ Việt Nam)
Tóm tắt AI
SWE-Bench ProMax là bộ tiêu chuẩn đánh giá mới với 170 bài toán thực tế, hỗ trợ 7 ngôn ngữ lập trình phổ biến nhằm khắc phục hạn chế của các bộ benchmark cũ trong việc kiểm thử khả năng tái cấu trúc mã của AI.
Bản dịch AI
Tác giả: Yuling Shi, Jinghan Xu, Kelin Fu, Wenhao Zeng, Shilin He, Lei Zhang, Yue Liu, Zelin Zhao, Terry Yue Zhuo, Jialun Cao, Siyu Ye, Tianyu Liu, Kai Cai, Shing-Chi Cheung, Xiaodong Gu
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Yuling Shi [xem email] [v1] Thứ Hai, 10 tháng 8 năm 2026 16:23:19 UTC (308 KB)
Bài viết được AI dịch và tổng hợp tự động từ HuggingFace Daily Papers (Nổi bậtBài nghiên cứu). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.