Hugging Face Daily Papers
85

Nghiên cứu

Tencent WorkBuddy Bench: Bộ tiêu chuẩn đánh giá AI lập trình đa lĩnh vực chống gian lận dữ liệu

(giờ Việt Nam)

Tóm tắt AI

Tencent giới thiệu WorkBuddy Bench, bộ tiêu chuẩn đánh giá tác nhân AI lập trình với các tác vụ được thiết kế từ tình huống thực tế, đảm bảo tính bảo mật và chống rò rỉ dữ liệu huấn luyện.

Bản dịch AI

Tác giả: Nhóm Tencent WorkBuddy Bench: Siqi Cai, Shaopeng Chen, Xiang Fei, Yong Mao, Zihan Xu, Zhiheng Lyu, Zhijian Shao, Yuchen Shi, Shuwen Zhang, Chaofan Qiu, Linjie Che, Xiaoxi Zhao, Feng Wu, Kai Zhang, Chaofan Zhu, Yubin Qi, Xiaoyun Liang, Peijie Dong, Yunhao Zhang, Yuanjie Zhu, Ling Jiang, Xianjun Zhang, Zhehang Chu, Anyuan Sang, Zhen Feng, Sen Nie, Shi Wu, Yuanzhen Xu, Xin Li, Ning Yang, Zhiqiang Dong, Hande Dong, Qiang Lin, Yi Liu, Yunsheng Wu, Ke Li, Xing Sun

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)

Lịch sử gửi bài

Từ: Zhiheng Lyu [xem email] [v1] Thứ Năm, 23 tháng 7 năm 2026 04:34:06 UTC (27.379 KB)

AI lập trìnhTencentĐánh giá AICoding AgentBenchmark
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.