Hugging Face Daily Papers
85

Nghiên cứu

VGI-BENCH: Đánh giá khả năng suy luận thị giác trong các mô hình tạo video

(giờ Việt Nam)

Tóm tắt AI

VGI-bench là bộ tiêu chuẩn mới gồm 27 tác vụ giúp đánh giá chuyên sâu khả năng suy luận thị giác của các mô hình tạo video hiện nay. Kết quả cho thấy ngay cả những mô hình mạnh nhất cũng chưa đạt hiệu suất ổn định, chỉ dừng lại ở mức 51%.

Bản dịch AI

Tác giả: Xuan He, Cong Wei, Yuhao Cheng, Linrui Ma, Yuxuan Zhang, Zuojun Li, Yuhao Wen, Jize Jiang, Zeyi Liu, Yuren Hao, Songcheng Cai, Keming Wu, Penghui Du, Kai Zou, Rui Yang, Chenkai Sun, Ke Yang, Ping Nie, Kelsey R Allen, Chenglong Wang, Michel Galley, Jianfeng Gao, ChengXiang Zhai

Xem PDF HTML (thử nghiệm)

DOI do arXiv cấp thông qua DataCite

Lịch sử gửi bài

Từ: Xuan He [xem email] [v1] Thứ Năm, 20/08/2026 02:56:56 UTC (11.382 KB) [v2] Thứ Hai, 24/08/2026 07:40:48 UTC (11.473 KB) [v3] Thứ Tư, 26/08/2026 01:14:41 UTC (11.473 KB)

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.