25/09

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

DeltaWAM: Mô hình hành động thế giới dựa trên sự thay đổi cho thao tác hai tay robot

DeltaWAM tối ưu hóa việc điều khiển robot bằng cách dự đoán các thay đổi hình ảnh thay vì toàn bộ khung hình, kết hợp với bộ nhớ Streaming Delta Memory để giảm tải xử lý, giúp tăng đáng kể tỷ lệ thành công trong các tác vụ thao tác phức tạp.

22/09

Thứ Ba · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 48/100

Tư duy như mô hình thế giới, hành động như VLA: Chưng cất tri thức vật lý vào robot nhỏ gọn

Phương pháp mới giúp chưng cất tri thức từ mô hình thế giới vào chính sách VLA, cho phép robot hiểu bối cảnh vật lý mà không cần tải mô hình giáo viên nặng nề khi huấn luyện.

15/09

Thứ Ba · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnMobileVLA-R1 2.0: Bước tiến mới trong điều khiển robot di động nhờ suy luận tăng cường RL

MobileVLA-R1 2.0 kết hợp suy luận có cấu trúc với học tăng cường (RL) để thu hẹp khoảng cách giữa tư duy ngôn ngữ cấp cao và hành động điều khiển robot chính xác, giúp robot thực hiện các nhiệm vụ phức tạp hiệu quả hơn.


Vì sao đáng đọc: Đây là nghiên cứu quan trọng trong lĩnh vực robot học, giải quyết bài toán hóc búa về sự nhất quán giữa suy luận và hành động thực tế bằng kỹ thuật CoT và RL.

02/09

Thứ Tư · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
Nghiên cứuĐiểm AI 45/100

DroneCATS: Đánh giá mô hình đa phương thức làm tác nhân điều khiển drone thông minh

Nghiên cứu giới thiệu kiến trúc DroneCATS, tích hợp trực tiếp mô hình đa phương thức vào hệ thống điều khiển drone để thực hiện các nhiệm vụ phức tạp như bám đuổi và tìm kiếm mà không cần tinh chỉnh. Kết quả cho thấy dù khả năng nhận diện không gian tốt, các mô hình vẫn gặp khó khăn trong việc duy trì giao thức hành động và xác định thời điểm kết thúc nhiệm vụ.

28/08

Thứ Sáu · 2 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnZero-WAM: Mô hình hóa hành động từ video người để robot thực hiện tác vụ mới

Zero-WAM là mô hình video-hành động cho phép robot thực hiện các tác vụ chưa từng học thông qua việc quan sát video hướng dẫn từ con người, giúp giải quyết bài toán tổng quát hóa trong điều khiển robot.


Vì sao đáng đọc: Đột phá trong việc ứng dụng học trong ngữ cảnh (ICL) vào robot học, giải quyết hiệu quả vấn đề thiếu hụt dữ liệu huấn luyện bằng cách tận dụng video con người.

23/08

Chủ Nhật · 1 tin

21/08

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnτ_0-VLA: Mô hình nền tảng robot phân cấp với khả năng tính toán linh hoạt nhờ mô hình thế giới

τ_0-VLA cải thiện khả năng thực hiện các tác vụ robot dài hạn bằng cách cho phép mô hình tự đánh giá và tìm kiếm phương án tối ưu trước khi hành động, thay vì chỉ phản hồi một lần duy nhất.


Vì sao đáng đọc: Đây là bước tiến quan trọng trong việc áp dụng cơ chế 'test-time compute' (tương tự o1 của OpenAI) vào điều khiển robot, giúp giải quyết các tác vụ phức tạp và dài hạn.
Tổng 8 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (22 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “AI điều khiển” | AIHOT.vn