Nghiên cứu
TurboVLA: Mô hình thị giác-ngôn ngữ-hành động thời gian thực đạt 32Hz trên RTX 4090
(giờ Việt Nam)
Tóm tắt AI
TurboVLA loại bỏ sự phụ thuộc vào LLM cồng kềnh, sử dụng kiến trúc nhẹ 0.2B tham số để đạt hiệu suất điều khiển robot ấn tượng với độ trễ cực thấp, chỉ 31.2ms trên GPU RTX 4090.
Bản dịch AI
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Dingkang Liang [xem email] [v1] Thứ Tư, 29 tháng 7 năm 2026 17:59:58 UTC (964 KB)
Bài viết được AI dịch và tổng hợp tự động từ HuggingFace Daily Papers (Nổi bậtBài nghiên cứu). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.