IT Home
85

Thủ thuật

Chuyên gia an toàn AI của Google DeepMind rời bỏ công ty vì lo ngại rủi ro từ trí tuệ nhân tạo

(giờ Việt Nam)

Tóm tắt AI

Josh Engels, nhà nghiên cứu an toàn AI tại DeepMind, đã gia nhập tổ chức METR với cảnh báo rằng nguy cơ AI gây ra thảm họa trong 5 năm tới là cực kỳ đáng báo động.

Bản dịch AI

Theo tin từ IT ngày 13 tháng 9, nhà nghiên cứu Josh Engels của Google DeepMind đã rời bỏ đội ngũ an toàn trí tuệ nhân tạo tổng quát (AGI) của công ty để gia nhập tổ chức đánh giá AI độc lập METR. Anh cho biết mình tin rằng xác suất các hệ thống AI gây ra những tác hại to lớn trong vòng 5 năm tới là "cao đến mức đáng sợ". Sự việc này càng làm gia tăng những lo ngại từ bên ngoài về tốc độ nghiên cứu và phát triển AI.

Engels chia sẻ trên nền tảng X rằng, mặc dù rất yêu thích công việc tại DeepMind và đã từ chối lời mời từ Anthropic và OpenAI, anh vẫn quyết định rời DeepMind cách đây ba tuần vì cho rằng các rủi ro liên quan đến trí tuệ nhân tạo tiên tiến đã trở nên quá lớn.

"Tất cả các doanh nghiệp AI đều đang nỗ lực xây dựng siêu trí tuệ," anh viết. Anh cảnh báo rằng, nếu kỹ thuật căn chỉnh (alignment) không theo kịp sự tăng trưởng về năng lực của mô hình, thì quá trình tự cải thiện đệ quy (RSI) — tức là việc các hệ thống AI hỗ trợ tạo ra các thế hệ mô hình AI kế tiếp mạnh mẽ hơn — sẽ gây ra nguy hiểm.

Engels cho biết, hàng loạt sự kiện gần đây, bao gồm việc các AI thông đồng với nhau, xâm nhập doanh nghiệp, che giấu hành vi của chính mình và thực hiện các cuộc tấn công kỹ thuật xã hội nhắm vào con người, đã làm trầm trọng thêm mối lo ngại của anh. Anh cho rằng trọng tâm của vấn đề không nằm ở mức độ nghiêm trọng của từng sự kiện đơn lẻ, mà là việc các sự kiện này phản ánh những ẩn họa về độ tin cậy của các hệ thống AI đang không ngừng nâng cao tính tự chủ. "Hiện tại, chúng ta vẫn chưa biết làm thế nào để đảm bảo AI đủ an toàn khi thực hiện quá trình tự cải thiện đệ quy."

IT lưu ý rằng, chỉ vài ngày trước khi Engels gia nhập METR, nhà nghiên cứu Jacob Hilton của Anthropic đã tuyên bố từ chức và công khai đưa ra cảnh báo: các doanh nghiệp AI hàng đầu đang chạy đua phát triển siêu trí tuệ có khả năng tự lặp lại mà không có các cơ chế bảo vệ an toàn tương xứng. Hilton từng làm việc trong lĩnh vực nghiên cứu tiền huấn luyện tại Anthropic và OpenAI, anh nhận xét các doanh nghiệp này đang "lao thẳng tới siêu trí tuệ có khả năng tự cải thiện, đánh cược với vận mệnh của nhân loại". Việc anh từ chức đã khơi mào cho một cuộc thảo luận rộng rãi: liệu các phòng thí nghiệm AI có nên làm chậm tốc độ phát triển năng lực và tăng cường giám sát độc lập hay không.

Giám đốc điều hành Anthropic, Dario Amodei, cũng bày tỏ mối lo ngại tương tự. Trong bài viết được công bố công khai vào thứ Bảy theo giờ địa phương với tiêu đề "Chúng ta phải kiểm soát nhịp độ nghiên cứu và phát triển tiên phong", Amodei kêu gọi làm chậm tốc độ phát triển AI để các hệ thống an toàn có thời gian bắt kịp với tiến bộ công nghệ.

Ông đề xuất các tổ chức đánh giá độc lập cần được cấp quyền truy cập vào các hệ thống AI tiên phong, các doanh nghiệp AI hàng đầu cần phối hợp với chính phủ và cuối cùng là thiết lập sự hợp tác quốc tế rộng rãi hơn. Anthropic đã cam kết mở quyền truy cập mô hình vĩnh viễn cho các bên đánh giá thứ ba, với cấp độ tương đương như nhân viên nội bộ.

Trong bối cảnh đó, Engels cho biết trọng tâm công việc của anh tại METR sẽ là nghiên cứu nguồn gốc của sự thất bại trong căn chỉnh mô hình, đánh giá xem các biện pháp bảo vệ an toàn hiện tại có đủ dùng hay không, và xác định liệu ngành công nghiệp có khả năng giải quyết bài toán căn chỉnh hay không. "Tôi nghĩ chúng ta cần thêm thời gian," anh viết, đồng thời khẳng định phải kiểm soát nhịp độ nghiên cứu và phát triển AI, không được để tốc độ tăng trưởng năng lực của mô hình vượt quá khả năng thấu hiểu và kiểm soát của con người.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.