Nghiên cứu
PerceptionBench: Bộ tiêu chuẩn đánh giá khả năng nhận diện thị giác cơ bản của các mô hình MLLM
(giờ Việt Nam)
Tóm tắt AI
PerceptionBench là bộ tiêu chuẩn mới giúp đánh giá chính xác khả năng nhận diện thị giác của các mô hình ngôn ngữ đa phương thức (MLLM) bằng cách tách biệt kỹ năng thị giác khỏi suy luận logic, thông qua 3.000 câu hỏi được kiểm chứng kỹ lưỡng.
Bản dịch AI
Tác giả: Zichao Lin, Yifeng Xie, Bowen Qu, Haiming Wang, Jia Li, Haoning Wu, Yuhao Dong, Zuhao Yang, Jinguo Zhu, Haoyu Lu, Zijia Zhao, Tongtian Yue, Zhangyang Qi, Junwei Yang, Mengfan Dong, Peizhou Cao, Chenzhuang Du, Zaida Zhou, Haotian Yao, Hao Yang, Hongcheng Gao, Lin Sui, Weihong Li, Xinxing Zu, Jia Chen, Yao Wang, Xiaoxue Wu, Yalin Wang, Y. Charles, Yiping Bao, Yangyang Liu, Zhiqi Huang, Xinyu Zhou
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Bowen Qu [xem email] [v1] Thứ Hai, 27 tháng 7 năm 2026 18:04:54 UTC (10.386 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.