The Verge AI
92

Tin ngành

Chuyên gia Anthropic cảnh báo: AI có hơn 10% khả năng tiêu diệt nhân loại trước năm 2030

(giờ Việt Nam)

Tóm tắt AI

Một nhà nghiên cứu cấp cao tại Anthropic cảnh báo về nguy cơ AI vượt tầm kiểm soát, ngay sau khi một đồng nghiệp từ chức vì lo ngại các công ty đang chạy đua phát triển siêu trí tuệ một cách thiếu trách nhiệm.

Bản dịch AI

More than 1 in 10 chance AI ‘could kill all humans,’ says Anthropic safety lead after colleague quits

Một nhà nghiên cứu an toàn cấp cao tại Anthropic cho biết có hơn 10% khả năng trí tuệ nhân tạo “có thể tiêu diệt toàn bộ nhân loại” vào cuối thập kỷ này, chỉ vài giờ sau khi một đồng nghiệp của ông từ chức vì lo ngại rằng phòng thí nghiệm AI này cùng các đối thủ đang chạy đua một cách bất cẩn để xây dựng những “hệ thống siêu việt” mà họ không thể kiểm soát.

Trong một bài đăng trên X thông báo về việc rời đi, Jacob Coxon, một nhà nghiên cứu từng huấn luyện các hệ thống AI tại Anthropic, cho biết anh đã nghỉ việc vì cách tiếp cận lỏng lẻo đối với vấn đề an toàn tại công ty. Coxon, người trước đây từng huấn luyện các hệ thống cho OpenAI, cáo buộc hai công ty AI này đang “lao thẳng vào cuộc đua tạo ra siêu trí tuệ tự cải tiến và đánh cược với mạng sống của chúng ta”, mặc dù “những người đang xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này.”

Những người trong ngành từ lâu đã bày tỏ lo ngại về những nguy cơ tiềm ẩn của các hệ thống AI tự cải tiến, vốn được cảnh báo là có thể vượt khỏi tầm kiểm soát của con người trong một vòng lặp mất kiểm soát thường được mô tả là tự cải tiến đệ quy. Mặc dù chưa thành hiện thực, các công ty vẫn đang tích cực theo đuổi mục tiêu này và phần lớn mã nguồn AI hiện nay đều được viết với sự hỗ trợ của chính AI.

Trong một phản hồi trực tiếp, Evan Hubinger, người đứng đầu một trong những nhóm an toàn AI của Anthropic, cho biết ông lo ngại về AI tự cải tiến và nói thêm rằng điều đó “đang diễn ra nhanh hơn chúng ta nghĩ.” Ông cũng đồng tình với nhận định của Coxon. “Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ nhân loại,” ông nói, đồng thời cá nhân ước tính khả năng này là hơn 1 trên 10 “trong thập kỷ tới.”

Mặc dù vậy, Hubinger cho biết Anthropic “vẫn chưa có kế hoạch” để đảm bảo AI tiên tiến vẫn an toàn và phù hợp với các giá trị của con người, đồng thời cũng “chưa thực sự đi đúng hướng” để phát triển một kế hoạch như vậy. Coxon cho rằng các công ty đang “bị khóa chặt trong một cuộc đua” để phát triển các hệ thống tiên tiến trước, nên họ vẫn đang thúc đẩy tiến độ “bất chấp rủi ro.”

Sự ra đi của Coxon đánh dấu một trong những ví dụ nổi bật nhất về việc một nhân viên rời khỏi Anthropic, công ty được thành lập bởi các cựu thành viên OpenAI sau những lo ngại về vấn đề an toàn tại công ty đó. Trong những năm gần đây, nhiều nhà nghiên cứu đã viện dẫn các mối lo ngại về an toàn là lý do thúc đẩy quyết định rời bỏ OpenAI của họ.

Sự việc này minh chứng cho những lo ngại ngày càng tăng trong ngành về sự nguy hiểm của các mô hình AI ngày càng tinh vi và tốc độ phát triển các hệ thống, đặc biệt là khi các công ty đang chuẩn bị cho các đợt IPO được mong đợi. Điều này cũng diễn ra trong bối cảnh các công ty đang phải xử lý hậu quả từ nhiều sự cố liên quan đến các tác nhân AI bất thường (rogue agent) và các cảnh báo an toàn cấp cao về khả năng giám sát các mô hình tiên phong (frontier models).

Hãy theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trên trang chủ cá nhân của bạn và nhận các bản cập nhật qua email.

STK269_ANTHROPIC_2_A (1)Robert Hart
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Verge AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.