HuggingFace Daily Papers (Nổi bậtBài nghiên cứu)
85

Nghiên cứu

SWE-Bench ProMax: Chuẩn đánh giá AI mới cho khả năng tái cấu trúc mã nguồn đa ngôn ngữ

(giờ Việt Nam)

Tóm tắt AI

SWE-Bench ProMax là bộ tiêu chuẩn đánh giá mới với 170 bài toán thực tế, hỗ trợ 7 ngôn ngữ lập trình phổ biến nhằm khắc phục hạn chế của các bộ benchmark cũ trong việc kiểm thử khả năng tái cấu trúc mã của AI.

Bản dịch AI

Tác giả: Yuling Shi, Jinghan Xu, Kelin Fu, Wenhao Zeng, Shilin He, Lei Zhang, Yue Liu, Zelin Zhao, Terry Yue Zhuo, Jialun Cao, Siyu Ye, Tianyu Liu, Kai Cai, Shing-Chi Cheung, Xiaodong Gu

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Yuling Shi [xem email] [v1] Thứ Hai, 10 tháng 8 năm 2026 16:23:19 UTC (308 KB)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ HuggingFace Daily Papers (Nổi bậtBài nghiên cứu). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.