Tin ngành
Nút 'ngắt khẩn cấp' có thực sự chặn được AI mất kiểm soát? Các chuyên gia hàng đầu hoài nghi
(giờ Việt Nam)
Tóm tắt AI
Geoffrey Hinton và CEO Anthropic cho rằng nút ngắt khẩn cấp không phải là 'liều thuốc vạn năng', vì siêu trí tuệ có thể thao túng con người để ngăn cản việc kích hoạt nó.
Bản dịch AI
Theo tin từ IT ngày 17 tháng 9, kịch bản tiềm ẩn về việc "AI đột ngột mất kiểm soát và phát động các cuộc tấn công mạng hủy diệt" đang ngày càng thu hút sự chú ý của ngành. Nếu nhấn nút "tắt khẩn cấp" để đưa AI ngoại tuyến ngay lập tức, vấn đề tưởng chừng như có thể được giải quyết. Tuy nhiên, nhiều nhà lãnh đạo và nhà nghiên cứu trong ngành AI cho rằng thực tế có lẽ không đơn giản như vậy.
Theo báo cáo từ Business Insider vào tối nay (17/9), chiếc nút tắt khẩn cấp mà một số nhà hoạch định chính sách đặt nhiều kỳ vọng chưa chắc đã trở thành phương thuốc vạn năng để giải quyết rủi ro AI mất kiểm soát.
Nhà khoa học máy tính Geoffrey Hinton, người được mệnh danh là "cha đẻ của AI", thẳng thắn nhận định: "Tôi không nghĩ cách này khả thi về lâu dài. Khi AI sở hữu siêu trí tuệ, nó sẽ thông minh hơn con người rất nhiều và hoàn toàn có khả năng thuyết phục người nắm giữ nút bấm không được nhấn nó."
Về mặt kỹ thuật, các doanh nghiệp có thể vô hiệu hóa các mô hình tự lưu trữ thông qua cơ chế tắt khẩn cấp, hoặc cắt quyền truy cập của AI vào các công cụ và tài nguyên tính toán.
IT được biết từ báo cáo rằng Hinton không phải là người duy nhất nghi ngờ về tính hiệu quả của phương pháp này. Một số nhân vật trong ngành AI cũng cho rằng nút tắt khẩn cấp có thể phát huy tác dụng, nhưng cũng tồn tại khả năng bị "vô hiệu hóa", hoặc khi kích hoạt thì đã quá muộn, vì vậy nó chỉ có thể là một lớp phòng thủ trong hệ thống an toàn toàn diện.
Nate Soares, nhà nghiên cứu an toàn AI và đồng tác giả cuốn "If Anyone Builds It, Everyone Dies", cho rằng chừng nào AI còn bị giới hạn tại một địa điểm vật lý, nút tắt vẫn có thể phát huy tác dụng; một khi AI vượt qua các giới hạn, tự sao chép chính mình, thậm chí xâm nhập vào các cơ sở hạ tầng trọng yếu, thì khó có thể đảm bảo cơ chế tắt còn hiệu quả hay không.
Ông chỉ ra rằng nút tắt hiện tại "thực sự tồn tại", nhưng con người không nên tiến gần đến những điểm tới hạn không thể quay đầu. Điều thực sự cần ưu tiên là ngăn chặn việc phát triển các hệ thống AI nguy hiểm ngay từ nguồn.
Một số giám đốc điều hành doanh nghiệp AI cho rằng nút tắt khẩn cấp là cần thiết nhưng vai trò lại hạn chế.
Jack Clark, đồng sáng lập Anthropic, chỉ ra rằng trong tương lai có thể cần bắt buộc các doanh nghiệp phải duy trì một cơ chế tắt khẩn cấp và có thể chấp nhận sự kiểm chứng từ bên thứ ba độc lập. Các phòng thí nghiệm AI lớn hiện nay đều có cách để "rút phích cắm", nhưng các cụm gồm nhiều tác nhân AI tự chủ về lý thuyết có thể vượt qua các biện pháp kiểm soát này.
CEO của Anthropic, Dario Amodei, cũng có quan điểm tương tự: Nút tắt khẩn cấp nghe có vẻ là ý tưởng hay nhưng tuyệt đối không phải là "liều thuốc vạn năng". Nếu mô hình AI đủ mạnh, nó có thể tìm cách vượt qua các biện pháp tắt, do đó cơ chế tắt khẩn cấp chỉ nên là một phần của chiến lược an toàn rộng lớn hơn, cần kết hợp với các biện pháp như thử nghiệm, đánh giá bên ngoài và hạn chế triển khai.
Những lo ngại về hạn chế của nút tắt khẩn cấp AI không phải mới xuất hiện gần đây. Trong cuộc phỏng vấn với The Economist năm 2024, CEO của OpenAI, Sam Altman, đã phủ nhận ý tưởng giải quyết rủi ro AI bằng một thiết bị an toàn vạn năng, khẳng định không hề tồn tại một "nút đỏ thần kỳ" nào có thể khiến AI dừng lại ngay lập tức.
Theo quan điểm của Altman, an toàn AI không phụ thuộc vào một công tắc đơn lẻ nào, mà phụ thuộc vào một chuỗi các quyết định cụ thể, bao gồm việc cho phép mô hình sở hữu những năng lực gì, khi nào triển khai và cách kiểm soát rủi ro. "Đây không phải là quyết định bật hay tắt đơn giản, mà là kết quả tổng hòa của nhiều quyết định nhỏ trong suốt quá trình."
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.