IT Home
85

Mô hình

Dyna Robotics ra mắt mô hình AI cho robot DYNA-2: Đạt tỷ lệ thành công 90% nhờ huấn luyện từ 1 triệu giờ video

(giờ Việt Nam)

Tóm tắt AI

Dyna Robotics giới thiệu mô hình nền tảng DYNA-2, được huấn luyện từ hơn 1 triệu giờ video góc nhìn thứ nhất, giúp robot cải thiện khả năng suy luận không gian và tương tác vật lý với độ chính xác lên tới 90%.

Bản dịch AI

Theo tin từ IT ngày 13 tháng 8, công ty trí tuệ nhân tạo hiện thân (embodied AI) Dyna Robotics vừa ra mắt mô hình nền tảng robot DYNA-2, được huấn luyện dựa trên hơn 1 triệu giờ video góc nhìn thứ nhất của con người, với tỷ lệ thành công trong các tác vụ lên tới 90%.

Về định vị, DYNA-2 được phía chính thức mô tả là Mô hình Hành động Thế giới (World Action Model), với mục tiêu học cách các hành động làm thay đổi thế giới vật lý thông qua việc quan sát hoạt động của con người. IT đính kèm ảnh chụp màn hình liên quan như sau:

Về khâu huấn luyện, quá trình tiền huấn luyện của DYNA-2 hoàn toàn dựa vào dữ liệu video của con người, với quy mô hơn 1 triệu giờ video góc nhìn thứ nhất, tương đương với 170 năm kinh nghiệm của con người.

Đồng sáng lập công ty, Jason Ma, cho biết robot đa năng từ lâu đã bị hạn chế bởi nút thắt dữ liệu, việc thu thập thủ công dữ liệu điều khiển từ xa (teleoperation) trong thế giới thực rất khó mở rộng để đạt tới trí tuệ đa năng, trong khi mô hình DYNA-2 học cách các hành động thay đổi thế giới vật lý bằng cách quan sát hoạt động của con người.

Công ty này tin rằng, việc DYNA-2 dự đoán cách thế giới vật lý vận động trước khi thực hiện hành động có thể giúp robot bù đắp khả năng suy luận không gian và tương tác vật lý mà các mô hình ngôn ngữ thị giác (vision-language models) truyền thống còn thiếu.

Thông qua hai mục tiêu huấn luyện là dự đoán nội dung khung hình video tiếp theo và dự đoán hành động cần thực hiện, mô hình này thu thập được thông tin về các mối quan hệ không gian, phương thức chuyển động cũng như cách các vật thể phản ứng sau khi bị tác động.

Kết quả do Dyna Robotics công bố cho thấy, khi bổ sung thêm dữ liệu video con người vào giai đoạn tiền huấn luyện, hiệu suất của robot trong 15 tác vụ chuẩn đã được cải thiện. Công ty gọi hiện tượng này là quy luật mở rộng từ người sang robot (human-to-robot scaling law) và cho biết hiệu suất sẽ tăng trưởng theo cách tương đối có thể dự đoán được khi quy mô dữ liệu huấn luyện mở rộng.

Trong một thí nghiệm, chỉ cần 13 phút dữ liệu chuyên dụng cho robot là đủ để hai bàn tay robot 5 ngón học được cách vặn mở nắp chai. Đối với các tác vụ sản xuất, trong điều kiện tập dữ liệu hậu huấn luyện không đổi, tỷ lệ thành công đã tăng từ khoảng 20% lên 80% đến 90% nhờ việc tăng quy mô tiền huấn luyện.

Dyna Robotics cũng cho biết, Dyna-2 đã đạt tỷ lệ đạt chuẩn 87% trong một lần triển khai cho khách hàng, trong khi thế hệ trước là Dyna-1 chỉ đạt 46%. Trong các tác vụ yêu cầu thực hiện những hành động khác nhau dựa trên chỉ dẫn của người dùng, việc huấn luyện phối hợp video đã giúp điểm số tăng 133%.

RobotAI hiện thânDYNA-2Dyna RoboticsCông nghệ AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.