Dân trí Công nghệ
85

Mô hình

Kết quả bất ngờ khi để AI tự 'táy máy' khám phá thế giới

(giờ Việt Nam)

Tóm tắt AI

Thay vì chỉ học từ dữ liệu có sẵn, các nhà khoa học đã tích hợp cơ chế 'tò mò' giúp robot tự chủ động khám phá và học hỏi từ môi trường xung quanh.

Bản dịch AI

Kết quả bất ngờ khi thả cho AI tự "táy máy"

Robot mô phỏng sử dụng cơ chế học dựa trên động lực nội tại có thể rút ngắn khoảng một nửa thời gian học ngôn ngữ so với các phương pháp truyền thống (Ảnh: Sohu).

Kết quả cho thấy tốc độ học ngôn ngữ được cải thiện đáng kể, đồng thời xuất hiện những hành vi ngoài dự kiến.

Một nghiên cứu từ Viện Khoa học và Công nghệ Okinawa (OIST, Nhật Bản) đã đề xuất một cách tiếp cận mới trong việc huấn luyện trí tuệ nhân tạo (AI), thay vì chỉ dựa vào việc dự đoán từ ngữ hoặc ghi nhớ lượng dữ liệu khổng lồ như các mô hình ngôn ngữ lớn (LLM).

Nhóm nghiên cứu đã xây dựng một hệ thống AI với cơ chế khám phá dựa trên "động lực nội tại", cho phép robot mô phỏng chủ động tìm hiểu các tình huống mới thay vì chỉ thực hiện những gì đã được lập trình sẵn.

Để thực hiện điều này, các nhà khoa học đã sử dụng mô hình Mạng thần kinh tái quy biến đổi lấy cảm hứng từ mã hóa dự đoán (Predictive Coding-inspired Variational Recurrent Neural Network - PV-RNN), kết hợp với thuật toán học tăng cường.

Hệ thống sẽ nhận được "phần thưởng" khi giảm thiểu được sự không chắc chắn trong quá trình khám phá môi trường, qua đó khuyến khích AI tiếp tục học hỏi.

Theo kết quả nghiên cứu, các robot mô phỏng sử dụng cơ chế này chỉ mất khoảng một nửa thời gian để học ngôn ngữ so với phương pháp huấn luyện thông thường.

Trong quá trình huấn luyện, nhóm nghiên cứu cũng ghi nhận một số hành vi ngoài kịch bản. Sau khi hoàn thành nhiệm vụ, robot vẫn tiếp tục tương tác với môi trường, chẳng hạn như đẩy hoặc làm dịch chuyển các vật thể để quan sát kết quả.

"Việc theo dõi các hành vi khám phá tự phát xuất hiện trong quá trình huấn luyện là điều khiến chúng tôi đặc biệt chú ý", Theodore Tinker, tác giả chính của nghiên cứu, cho biết.

Nghiên cứu cũng chỉ ra rằng hiệu quả của cơ chế này phụ thuộc đáng kể vào mức độ đa dạng của dữ liệu huấn luyện.

Khi robot được tiếp xúc với 48 tổ hợp ngôn ngữ, khả năng hiểu các mệnh lệnh mới chỉ đạt khoảng 25%. Tuy nhiên, khi số lượng tổ hợp tăng lên 180, tỷ lệ khái quát hóa đã đạt khoảng 85%.

Một hiện tượng đáng chú ý khác là robot tái hiện "đường cong học tập hình chữ U", vốn từng được quan sát trong quá trình trẻ em tiếp thu ngôn ngữ. Ban đầu, hệ thống ghi nhớ tốt các trường hợp riêng lẻ, sau đó kết quả tạm thời giảm xuống khi bắt đầu hình thành quy tắc chung, trước khi tiếp tục cải thiện và đạt khả năng khái quát hóa cao hơn.

Theo nhóm nghiên cứu, kiến trúc PV-RNN còn có ưu điểm là cho phép theo dõi trạng thái nội tại của mô hình trong quá trình học, giúp các nhà khoa học hiểu rõ hơn cách AI đưa ra quyết định.

Điều này có thể hỗ trợ phát triển các hệ thống AI linh hoạt hơn, đồng thời cung cấp thêm dữ liệu để nghiên cứu cơ chế con người tiếp thu ngôn ngữ.

Chiếc iPhone VN/A rẻ nhất Việt Nam giảm còn 11,49 triệu, lựa chọn "ngon - bổ - rẻ" năm 2026OPPO A6T mẫu điện thoại giá rẻ có NFC, pin trâu 6100 mAhGiá iPhone 17 Air lại lao dốc mạnh, mạnh vô đối trong phân khúc3 mẫu iPhone chính hãng rẻ nhất hiện nay, giá chỉ từ hơn 11 triệu đồngMacBook Air M5 tăng giá tại Việt Nam, cấu hình mạnh hơn nhưng vẫn tồn tại nhược điểm
AIRobotHọc máyCông nghệ mớiTự động hóa
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Dân trí Công nghệ. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.