Nghiên cứu
SpatialBlock: Nâng cao trí tuệ không gian cho mô hình ngôn ngữ thị giác qua bài toán xếp khối
(giờ Việt Nam)
Tóm tắt AI
SpatialBlock-15k là tập dữ liệu tổng hợp mới giúp mô hình LVLM cải thiện khả năng hiểu cấu trúc 3D từ ảnh 2D thông qua các bài tập xếp khối, thay thế cho việc gán nhãn hình học thủ công tốn kém.
Bản dịch AI
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Soohyun Ryu [xem email] [v1] Thứ Hai, 7 tháng 9 năm 2026 05:41:13 UTC (1.379 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.