Nghiên cứu
Masked Visual Actions: Bước tiến mới trong mô hình hóa thế giới cho robot
(giờ Việt Nam)
Tóm tắt AI
Nghiên cứu giới thiệu phương pháp Masked Visual Actions, cho phép robot điều khiển thông qua các quỹ đạo hình ảnh ẩn, giúp mô hình dự đoán phản ứng vật lý của thế giới thực một cách chính xác chỉ với 15 giờ dữ liệu huấn luyện.
Bản dịch AI
Tác giả: Hadi Alzayer, Wenlong Huang, Haonan Chen, Christopher Luey, Lvmin Zhang, Maneesh Agrawala, Gordon Wetzstein, Li Fei-Fei, Yilun Du, Jiajun Wu, Jia-Bin Huang
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Hadi Alzayer [xem email] [v1] Thứ Ba, 21 tháng 7 năm 2026 17:59:11 UTC (25.477 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.