Nghiên cứu
VideoCoCo: Hệ thống tác nhân kép sử dụng mã nguồn để tạo video nhất quán về vật lý
(giờ Việt Nam)
Tóm tắt AI
VideoCoCo giải quyết vấn đề thiếu nhất quán vật lý trong video AI bằng cách sử dụng mã Blender làm chuỗi suy luận (CoT), cho phép mô phỏng chính xác các chuyển động trong không gian và thời gian trước khi tạo hình ảnh.
Bản dịch AI
Tác giả: Haodong Li, Tianfei Ren, Xiaoxiao Ma, Chunmei Qing, Zhen Fang, Sipeng He, Ziyu Guo, Haoyu Wu, Juanxi Tian, Yihang Zou, Ruichuan An, Dongzhi Jiang, Boxue Yang, Ji Xie, Xu Huang, Wenhao Yan, Jialv Zou, Zhengrong Yue, Yaxin Luo, Xiaotong Li, Yuzhu Wang, Junyan Ye, Jinjing Zhao, Zehui Chen, Lin Chen, Renye Yan, Feng Zhao, Pheng-Ann Heng
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Juanxi Tian [xem email] [v1] Thứ Tư, 29 tháng 7 năm 2026 18:38:23 UTC (6.070 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.