Light Origins vừa phát hành Light-O1-Preview, mô hình 6B theo giấy phép Apache-2.0 có khả năng chuyển đổi dữ liệu video hành động của con người thành quỹ đạo chuyển động toàn thân cho robot, tách biệt với hệ thống điều hướng LightNav-0.
Nghiên cứu giới thiệu Latent Interface Training (LIT), một chiến lược huấn luyện hai giai đoạn giúp robot tránh phụ thuộc vào các tín hiệu thị giác không liên quan, từ đó cải thiện khả năng thích nghi khi môi trường thay đổi.
Vì sao đáng đọc: Giải quyết vấn đề cốt lõi về khả năng tổng quát hóa của robot AI. Phương pháp LIT có tính ứng dụng cao trong việc huấn luyện các mô hình nền tảng cho robot thực tế.
SyncWorld là mô hình thế giới có khả năng mô phỏng robot zero-shot mà không cần huấn luyện thêm, bằng cách sử dụng hiệu chỉnh thị giác để đồng bộ hóa hành động với môi trường thực tế.
Vì sao đáng đọc: Giải quyết vấn đề cốt lõi trong robot học là sự thiếu nhất quán giữa hành động và hình ảnh, mở ra hướng đi mới cho việc huấn luyện robot trong môi trường mô phỏng.
RoboSPA là bộ dữ liệu và chuẩn đánh giá mới giúp kiểm tra khả năng suy luận không gian và lập kế hoạch dài hạn của các mô hình VLA trong lĩnh vực robot, vượt xa các bài kiểm tra cơ bản hiện nay.
Hydra-0 là mô hình thế giới mới sử dụng 'dòng hành động' (action flow) để biểu diễn chuyển động robot dưới dạng pixel, giúp cải thiện đáng kể độ chính xác trong điều khiển và khả năng thích nghi với nhiều tác vụ robot khác nhau.
Vì sao đáng đọc: Đây là bước tiến đột phá trong việc hợp nhất mô hình thế giới và điều khiển robot, giải quyết hiệu quả bài toán chuyển đổi hành động sang chuyển động hình ảnh.
Tổng 5 tin, không còn tin nào nữa
40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (20 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả