Gary Marcus: The Road to AI We Can Trust
85

Thủ thuật

Gary Marcus phản bác dự đoán AI diệt vong: Đừng quá lo lắng về viễn cảnh tận thế

(giờ Việt Nam)

Tóm tắt AI

Gary Marcus cho rằng khả năng AI tiêu diệt nhân loại trước năm 2030 gần như bằng không, đồng thời kêu gọi tập trung vào các rủi ro thực tế như vũ khí sinh học và tin giả thay vì những kịch bản viễn tưởng.

Bản dịch AI

No, Anderson Cooper, AI is not going to kill all humans by 2030

Anderson Cooper trông khá lo lắng ở đây, khi Jacob Coxon, cựu nhân viên OpenAI/Anthropic và là "gương mặt vàng" của truyền thông hiện tại, nói với chúng ta rằng loài người có thể sẽ không còn tồn tại trong năm năm tới.

Tôi ở đây để nói với bạn rằng Anderson Cooper không cần phải lo lắng về kịch bản cụ thể đó, và bạn cũng vậy.

Trước khi đi sâu vào vấn đề, tôi muốn làm rõ một vài điều. Một nhóm người, dường như thuộc phe cánh hữu, đang cố gắng hạ bệ nhân phẩm của Coxon. Tôi đã thấy những lời dối trá về thời gian làm việc của anh ấy tại Anthropic, có khả năng bắt nguồn từ một hồ sơ không chính xác do AI tạo ra, cùng một chuỗi bài đăng có tính công kích mô tả anh ấy (mà không có bằng chứng thực tế) là một đặc vụ của Đảng Dân chủ. Ai đó đã mô tả anh ấy là nhân viên cấp thấp, điều này thật vô lý vì anh ấy đã từng làm việc tại OpenAI trong một đội ngũ kỹ thuật hơn hai năm.

Thực tế, chúng ta cần một chút tinh tế ở đây; một số điều Coxon nói là đúng, một số chỉ là suy đoán; một số vấn đề anh ấy có đủ tư cách để phát biểu, và một số khác nằm ngoài chuyên môn của anh ấy. (Truyền thông cũng quá ít khi phân biệt được điều này).

Điều tôi thích ở chuỗi bài đăng hiện đang gây tranh cãi của Coxon là nó đã làm sáng tỏ những gì mọi người tại OpenAI và Anthropic đang suy nghĩ. Vì anh ấy đã làm việc ở đó tổng cộng khoảng ba năm (chủ yếu tại OpenAI, nhưng gần đây nhất là tại Anthropic), nên có thể cho rằng anh ấy ở vị thế có thể làm chứng cho những suy nghĩ phổ biến (có lẽ không phải là tất cả) tại các công ty đó.

Phần quan trọng nhất trong chuỗi bài đăng của anh ấy là phần đề cập đến trạng thái tâm lý:

cáo buộc đúng đắn các công ty tiên phong về sự kiêu ngạo:

Bằng chứng xác thực sớm đến từ Evan Hubinger, một nhân viên hiện tại của Anthropic:

X avatar for @EvanHub

Evan Hubinger@EvanHub

Jacob nói đúng—chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ nhân loại! Cá nhân tôi nghĩ khả năng đó là >10% trong thập kỷ tới. Tôi tin rằng Anthropic đang cố gắng hết sức, nhưng chúng tôi vẫn chưa có kế hoạch giải quyết vấn đề căn chỉnh (alignment) cho siêu trí tuệ và chưa thực sự đi đúng hướng để làm điều đó.

X avatar for @hilbertspaess

Jacob Coxon @hilbertspaess

Những người xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này. Đây không phải là một chiêu trò tiếp thị. Nếu có, nhiều giám đốc điều hành và nhà nghiên cứu cấp cao sẽ chọn lọc cách diễn đạt trên báo chí để nghe có vẻ hợp lý - nhưng tôi nghe chính những người đó bày tỏ nỗi sợ hãi.

1:27 SA · 9 tháng 9, 2026 · 37,2 triệu lượt xem

4,35 nghìn lượt trả lời · 8,72 nghìn lượt đăng lại · 54,6 nghìn lượt thích

Và những người khác cuối cùng cũng lên tiếng; nhà khoa học trưởng của OpenAI thực sự đã nói điều tương tự. Có lý do chính đáng để tin rằng ít nhất một số công ty thực sự tin vào điều này, và (đáng sợ thay) nhiều người trong số họ đã đưa ra những lý lẽ để tin rằng việc tiếp tục phát triển một công nghệ mà chính họ cho là nguy hiểm là điều ổn thỏa.

Nhưng… có ít lý do hơn để tin rằng những người tại các công ty này có kiến thức sâu rộng về cách thế giới vận hành ngoài chuyên môn kỹ thuật của họ.

Thật vậy, có lý do chính đáng để nghi ngờ rằng những người được gọi là "Doomer" (những người bi quan về AI) không hề biết mình đang làm gì trong việc tạo ra thay đổi trong thế giới thực, hay thậm chí là suy nghĩ thấu đáo về hậu quả từ hành động của chính họ. Họ rất giỏi trong việc thu hút sự chú ý (cuốn sách bán chạy của Yudkowsky/Soares, cuốn sách bán chạy của Bostrom, chuỗi bài đăng của Coxon, bức thư kêu gọi tạm dừng AI, v.v.). Và họ rất giỏi trong việc huy động nguồn tài trợ khổng lồ, có lẽ gần (nếu không muốn nói là hơn) một tỷ đô la cho đến nay.

Nhưng theo quan điểm của tôi, tác động ròng của một thập kỷ "Doomer" nói chuyện (Coxon có vẻ là một thành viên chính thức của nhóm đó) là làm cho các công ty AI tiên phong trở nên giàu có và quyền lực hơn. Khi làm như vậy, họ cũng đã tiếp tay cho sự tập trung quyền lực vốn dĩ đã rất nguy hiểm. Mỗi khi họ hét lên rằng AI sẽ giết chết tất cả chúng ta, các nhà đầu tư mạo hiểm lại đổ thêm hàng tỷ đô la vào. Không có công trình nghiên cứu an toàn AI nào mà các Doomer tài trợ dẫn đến một giải pháp thực tế, được triển khai cho vấn đề cốt lõi. Việc tiếp tay cho OpenAI và Anthropic có thể chứng minh là một trong những điều tồi tệ nhất mà nhân loại từng làm, và họ đã đóng một vai trò lớn trong đó với những kịch tính không hồi kết của mình.

Hơn nữa, các Doomer dường như luôn đánh giá thấp nhân loại, như tôi sẽ thảo luận dưới đây. Và (như cũng được thảo luận dưới đây) họ dường như không biết chút gì về cách chiến tranh vận hành—điều này rất quan trọng vì họ đang ngầm định hoặc công khai tưởng tượng ra một cuộc chiến tranh hủy diệt giữa con người và máy móc.

Ngay cả khi bạn tin rằng máy móc đang cố gắng chiếm lấy thế giới (điều mà tôi không tin, ít nhất là không phải hiện tại hay trong tương lai gần), và rằng chúng là siêu trí tuệ (cũng chưa đúng, mặc dù có lẽ cuối cùng sẽ đúng), và ngay cả khi bạn gạt bỏ sự hoài nghi về việc rút phích cắm máy móc, bạn vẫn phải suy nghĩ thấu đáo về việc làm thế nào mà sự kết hợp giữa động cơ và siêu trí tuệ lại dẫn đến sự hủy diệt hoàn toàn loài người.

Tôi chưa bao giờ, chưa bao giờ thấy bất kỳ ai từ thế giới đó giải quyết câu hỏi sau cùng đó một cách tinh tế và phức tạp. Chắc chắn Coxon (cho đến nay) vẫn chưa làm được điều đó.

Nỗ lực tốt nhất mà tôi từng thấy, nếu có thể gọi là như vậy, là một cuốn sách cực kỳ phổ biến cách đây một năm, "If Anyone Builds It, Everybody Dies" của Eliezer Yudkowsky và Nate Soares.

Cuốn sách có nhiều điểm đáng chú ý, vừa là một tác phẩm khoa học viễn tưởng thú vị, vừa là lời kêu gọi mọi người nghiêm túc xem xét rủi ro từ AI.

Nhưng phần mô tả cách AI có thể thực sự tiêu diệt nhân loại lại yếu ớt, lan man và không thuyết phục. Tờ New York Times Book Review đã bác bỏ nó như thể đó là giáo phái Scientology. Tôi đã nhẹ nhàng hơn trên tờ Time Literary Supplement và ít bác bỏ hơn, xem xét các chi tiết của cuốn sách một cách nghiêm túc hơn nhiều, nhưng cuối cùng lập luận của cuốn sách vẫn còn nhiều lỗ hổng vì nhiều lý do.

Dưới đây là một số đoạn trích từ những gì tôi đã viết lúc đó, một năm trước, tất cả vẫn còn rất phù hợp.

Đoạn đầu tiên tóm tắt lập luận của Yudkowsky/Soares. Tôi cho rằng Coxon (người chưa đưa ra lập luận rõ ràng theo những gì tôi biết) đang dựa vào một thứ gì đó tương tự:

Tin xấu là Tiền đề 1 (xin lỗi vì tôi không thể dùng cách viết kiểu Anh) gần như chắc chắn là đúng, mặc dù tôi thực sự nghi ngờ nó sẽ xảy ra vào năm 2030. (Rất nhiều nhà nghiên cứu AI nổi tiếng như Rich Sutton, Yann LeCun và có lẽ cả Ilya Sutskever và Fei-Fei Li sẽ đồng ý với tôi về điều đó; tất cả chúng tôi đều nghĩ rằng lĩnh vực này cần nhiều đột phá hơn trước khi đạt đến siêu trí tuệ.)

Đó đã là lý do để Anderson Cooper thở phào nhẹ nhõm; chúng ta có nhiều thời gian hơn một chút trước khi siêu trí tuệ xuất hiện so với những gì Coxon dường như thừa nhận. (Lưu ý rằng Transformers mất 9 năm để đạt đến trạng thái hiện tại; ngay cả khi có một bước đột phá mới bây giờ, có thể mất nhiều năm để phát triển hoàn toàn. Và chúng ta có lẽ cần nhiều hơn một bước đột phá, như tôi sẽ thảo luận trong một bài luận tương lai.)

Tin tốt cho nhân loại là tiền đề thứ hai và thứ ba trong lập luận của Yudkowsky/Soares còn lung lay hơn rất nhiều. Trích dẫn những gì tôi đã nói năm ngoái trên TLS:

[Lưu ý rằng sự cố OpenAI Hugging Face đã bị kích động như một phần của bài tập huấn luyện, với các rào cản bảo vệ bị tắt một phần, chứ không phải là điều gì đó xảy ra một cách tự nhiên và tự phát.]

Nếu tiền đề thứ hai có vẻ phi thực tế đối với máy móc, thì tiền đề thứ ba có vẻ phi thực tế đối với con người:

Tôi đã gửi bài đánh giá cho Yudkowsky nhưng không bao giờ nhận được phản hồi. Cho đến nay, tôi biết tất cả các luận điểm của mình về sự kháng cự của con người vẫn còn nguyên giá trị.

Chắc chắn Coxon (cho đến nay) chưa thêm bất cứ điều gì thực chất vào lập luận đó.

Theo quan điểm của tôi, khả năng AI sẽ loại bỏ con người trong năm năm tới gần như bằng không. Con người quá phân tán về mặt địa lý, quá đa dạng về mặt di truyền và quá tháo vát để có thể dễ dàng sụp đổ hoàn toàn. Ý tưởng cho rằng AI sẽ giết chết tất cả chúng ta trong năm năm là điều vô lý.

AIGary MarcusRủi ro AIĐạo đức AICông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Gary Marcus: The Road to AI We Can Trust. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.