TechCrunch: AI
85

Thủ thuật

Podcast TechCrunch Equity: Giải mã động cơ đằng sau những cảnh báo 'diệt vong' từ giới AI

(giờ Việt Nam)

Tóm tắt AI

Podcast thảo luận về làn sóng lo ngại AI đe dọa nhân loại, bắt nguồn từ việc nhân viên Anthropic từ chức và các tuyên bố gây sốc về xác suất AI gây nguy hiểm trong thập kỷ tới.

Bản dịch AI

What’s behind the AI industry’s latest warnings of doom?

Ngành công nghiệp AI dường như đang có cuộc tranh luận gay gắt nhất từ trước đến nay về việc liệu công nghệ này có gây ra mối đe dọa hiện hữu đối với nhân loại hay không.

Cuộc thảo luận hiện tại bắt đầu sau khi nhà nghiên cứu AI Jacob Coxon cho biết anh đã từ chức tại Anthropic vì lo ngại rằng các công ty AI hàng đầu đang “đánh cược với mạng sống của chúng ta.” Sau đó, trưởng bộ phận căn chỉnh (alignment lead) của Anthropic đã lên tiếng trong một bài đăng với tuyên bố: “Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ nhân loại!”, đồng thời nói thêm rằng cá nhân anh cho rằng khả năng này là “>10% trong thập kỷ tới.”

Trong tập mới nhất của podcast Equity trên TechCrunch, Kirsten Korosec, Sean O’Kane và tôi đã thảo luận về những cảnh báo tận thế gần đây. Tôi đã cố gắng trình bày lý do tại sao tôi hoài nghi về nhiều câu chuyện “AI doomer” (những người bi quan về AI), trong khi Kirsten đặt câu hỏi liệu đây có phải là “một cách kỳ lạ để khoe khoang nhằm cho thấy mô hình AI của công ty họ đã tiến xa đến mức nào hay không”, đặc biệt là khi các công ty này đang chuẩn bị phát hành cổ phiếu ra công chúng.

Và Sean tự hỏi liệu những lo ngại này có thể xuất hiện trong hồ sơ S-1 của Anthropic cho đợt IPO hay không: “Liệu có những luật sư cấp dưới nào đang phải xem xét và viết lại toàn bộ phần đó trong hồ sơ S-1 để nói rằng: ‘Đây chính thức là quan điểm của Anthropic rằng có hơn 10% khả năng chúng tôi có thể phát triển thứ gì đó tiêu diệt toàn bộ nhân loại và điều đó sẽ gây hại nghiêm trọng cho hoạt động kinh doanh của chúng tôi’ hay không’?”

Hãy tiếp tục đọc để xem trước cuộc trò chuyện của chúng tôi, đã được biên tập lại để đảm bảo độ dài và sự rõ ràng. (Lưu ý: Chúng tôi đã ghi âm tập này trước khi CEO Dario Amodei của Anthropic công bố kế hoạch phát triển AI thận trọng hơn.)

Sean O’Kane: Tôi khó mà nghĩ ra điều gì bùng nổ nhanh đến thế. Không chỉ có phát súng cảnh báo này đến từ một nhà nghiên cứu trẻ, người từng làm việc tại OpenAI, mà nó còn được chia sẻ ngay lập tức trên X bởi trưởng bộ phận căn chỉnh tại Anthropic — người, trong một khoảnh khắc có thể coi là một trong những dấu chấm than đặt sai chỗ nhất từ trước đến nay, đã chia sẻ bài đăng và chuỗi thảo luận của Coxon rồi nói: “Chúng tôi thực sự tin rằng AI có thể tiêu diệt toàn bộ nhân loại!” Dấu chấm than đấy!

Một bầu không khí thật kỳ quặc. Đó giống như đổ thêm dầu vào một bài đăng hoặc chuỗi bài đăng vốn đã căng thẳng. Sau vụ hack Hugging Face từ mô hình nội bộ của OpenAI, cộng với những khả năng ngày càng tăng mà chúng ta thấy ở các mô hình mới nhất do Anthropic và giờ là OpenAI với Astra phát hành vài tuần trước, tôi nghĩ đây là thời điểm hoàn hảo để tạo ra một "thùng thuốc súng" cho những phát ngôn của nhà nghiên cứu trẻ này.

Anthony Ha: Chỉ để phản bác lại bạn, tôi thực sự nghĩ rằng nếu bạn tin AI có thể tiêu diệt toàn bộ nhân loại, thì điều đó xứng đáng có một dấu chấm than. Tôi cho rằng đó là một dấu chấm than được sử dụng hoàn toàn hợp lý!

Vấn đề của tôi với dòng tweet đó nằm ở từ “chúng tôi”. “Chúng tôi” ở đây là ai? Chúng ta có thể nói về cộng đồng AI hay cộng đồng nghiên cứu AI như một khối thống nhất đến mức nào? Và con số hơn 10% — đó chỉ là một con số được bịa ra, nó chẳng có ý nghĩa gì cả. Đôi khi [có] thói quen trong cả ngành công nghệ và những nơi khác là cứ đưa ra những tỷ lệ phần trăm này, chúng không dựa trên bất cứ điều gì hoặc được tính toán dựa trên bất cứ cơ sở nào. [Khi nhìn lại, tôi nhận ra dòng tweet đó có lẽ đang đề cập đến khái niệm P(doom), nhưng tôi vẫn thấy nó thật ngớ ngẩn.]

Một điều tôi muốn nói về tuyên bố và quyết định của Coxon là — có một chủ đề lặp đi lặp lại trên Equity, khi một người như Sam Altman hay Dario Amodei đưa ra câu chuyện bi quan này, luôn có một yếu tố là: Vậy thì, tại sao bạn lại làm những gì bạn đang làm? Nếu bạn thực sự tin rằng [AI có thể tiêu diệt nhân loại], bạn sẽ không tiếp tục làm điều đó nữa.

[Trong khi đó] đây thực sự là một người đang hành động đúng như những gì mình nói. Anh ấy thực sự đang nói: “Tôi tin rằng điều này thực sự, thực sự, thực sự tồi tệ, và tôi không muốn tiếp tục làm việc với nó nữa.” Vì vậy, ít nhất thì cũng phải dành lời khen cho lòng can đảm khi làm điều đó.

Kirsten Korosec: Đúng vậy, tôi xếp anh ấy vào một nhóm khác với tất cả những người còn lại đang nói về điều đó và bàn luận về những mối nguy hiểm.

Tôi sẽ đặt giả thuyết của mình ra, vì tôi muốn hỏi cả hai bạn một câu hỏi: Liệu có khả năng là mỗi khi chúng ta thấy số lượng bài đăng trên blog ngày càng tăng về một sự cố khác mà trong đó một trong các tác nhân AI của họ vượt tầm kiểm soát một cách không chủ ý, hoặc họ nói về việc nhân loại đang gặp rủi ro, thì đây có phải là một cách kỳ lạ để khoe khoang nhằm cho thấy mô hình AI của công ty họ đã tiến xa đến mức nào không?

Ý tôi là, điều đó nghe có vẻ rất hoài nghi, nhưng nó thực sự đạt được mục đích đó. Đó là: Nếu các mô hình AI này không tiên tiến, không có khả năng và không vượt tầm kiểm soát, thì chúng ta sẽ không phải lo lắng về những điều này, phải không? Nó giống như một cách rất kỳ lạ để khoe khoang về khả năng của các mô hình mà bạn đã tạo ra trong chính công ty của mình.

Anthony: Tôi chắc chắn đã tự hỏi về điều này. Tôi không nghĩ nó hoàn toàn là sự hoài nghi, theo nghĩa là tôi không nghĩ tất cả chỉ là một chiêu trò tiếp thị có ý thức trên diện rộng. Tôi nghĩ rằng khi rất nhiều người trong số họ — dù là nhà nghiên cứu hay CEO — nói về điều đó, họ thực sự có mối lo ngại thực sự.

Nhưng tất nhiên, điều đó cũng phù hợp với lợi ích kinh doanh [của họ] theo nhiều cách, khi nói rằng: “Ồ, chúng tôi đã tạo ra phần mềm chết chóc nhất từng được chế tạo.” Tôi không muốn phân tích tâm lý quá sâu ở đây, nhưng những người khác đã chỉ ra rằng có một sự cám dỗ ở cấp độ cá nhân là: Tất nhiên, bạn muốn tin rằng thứ bạn đang làm là thứ quan trọng nhất và nguy hiểm nhất trên thế giới.

Sean: Điều đọng lại trong tâm trí tôi khi nghĩ về câu hỏi đó là, chắc chắn có một yếu tố khiến nó có vẻ như: “Được rồi, chúng tôi đang làm điều này rất có năng lực, và điều đó tốt cho chúng tôi theo một cách nào đó, ngay cả khi nó trông có vẻ tệ dưới nhiều góc độ khác nhau.”

Tôi nghĩ điều khác biệt về một số ví dụ gần đây nhất là, nó thực sự mang lại cho bạn cảm giác rằng các công ty này không kiểm soát được những thứ này theo một số cách nhất định, đặc biệt là với những thứ liên quan đến OpenAI.

Chúng ta liên tục thấy ngày càng nhiều báo cáo về các tác nhân nội bộ khác đã truy cập vào các wiki khác nhau trên web và để lại tin nhắn cho nhau, theo cách không có vẻ như đang được xử lý một cách có năng lực từ phía OpenAI. Tôi tưởng tượng rằng sẽ có một chút trau chuốt hơn cho câu chuyện được kể, nếu mục đích hoàn toàn là để khiến mọi người tin rằng: “Ôi trời, họ đã tạo ra thứ gì đó cực kỳ có năng lực.”

Điều khác mà tôi nghĩ thực sự hấp dẫn về điều này, cụ thể là [là] chúng ta còn bao lâu nữa, tối đa vài tuần nữa là thấy hồ sơ S-1 của Anthropic cho đợt IPO, và chỉ còn vài tuần hoặc một hoặc hai tháng nữa là đến đợt IPO tiềm năng.

Và ý tưởng rằng bạn sẽ công khai và nói những điều này bằng ngôn ngữ rõ ràng trước khi IPO — tôi rất quan tâm đến ý nghĩa của điều đó đối với quá trình này. Họ đã viết bao nhiêu thứ như thế này vào S-1 và các yếu tố rủi ro bên trong tài liệu đó? Liệu có những luật sư cấp dưới nào đang phải xem xét và viết lại toàn bộ phần đó trong hồ sơ S-1 để nói rằng: “Đây chính thức là quan điểm của Anthropic rằng có hơn 10% khả năng chúng tôi có thể phát triển thứ gì đó tiêu diệt toàn bộ nhân loại và điều đó sẽ gây hại nghiêm trọng cho hoạt động kinh doanh của chúng tôi” hay không?

Kirsten: Bạn đang giả định rằng nó chưa có trong đó.

Sean: Đó là điều tôi đang nói: Liệu nó đã có trong đó và đang được diễn đạt lại? Hay đây là một sự xáo trộn thực sự? Chắc chắn phải có ngôn ngữ trong đó. Đó là một trong những lý do tôi rất háo hức đọc tài liệu này theo cách thậm chí còn đi xa hơn, theo một số cách, so với [S-1] của SpaceX, vì tôi chắc chắn rằng có lẽ có những thứ cụ thể liên quan đến những ý tưởng này sẽ rất thú vị để xem.

Kirsten: Vấn đề là thế này: Trong một môi trường đầu tư truyền thống, người ta có thể tin rằng ngôn ngữ như thế này sẽ làm tổn hại đến định giá của một công ty, vì nó đột nhiên trở nên nguy hiểm. Nhưng chúng ta không sống trong thời bình thường.

Và vì vậy, quay lại quan điểm của tôi, nó có thể kết thúc bằng việc trở thành một cách khoe khoang có lợi kỳ lạ cho công ty về mặt định giá. Nó không giống như toàn bộ xu hướng "rage-baiting" (câu tương tác bằng sự phẫn nộ) mà chúng ta đã thấy năm ngoái, nhưng nó nằm trong cùng một vũ trụ, nơi mà sức mạnh, khả năng, thậm chí cả các yếu tố nguy hiểm của một thứ gì đó, tương đương với định giá cao. Vì vậy, tôi đoán chúng ta sẽ thấy trong vài tuần nữa.

Gạt điều đó sang một bên trong một phút, điều gì đang được thực hiện về vấn đề này? Và liệu chúng ta có thể kiểm soát điều này không? Giám đốc điều hành Hoa Kỳ của một tổ chức phi lợi nhuận có tên là ControlAI, Connor Leahy, đã tham gia chương trình tuần này để nói về điều đó. Vậy bạn đang chú ý đến điều gì về cách kiểm soát các khía cạnh nguy hiểm của AI, hay chúng ta đang buông xuôi và nhìn mọi thứ diễn ra?

Anthony: Bản thân tôi không nhất thiết có câu trả lời hay cho điều này, nhưng tôi đã suy nghĩ về một số khía cạnh của cuộc tranh luận này và có lẽ tại sao tôi lại phản ứng theo cách tôi làm.

Để lặp lại một trong những quan điểm của Sean, tôi thực sự nghĩ rằng một phần của điều này nói lên mức độ mà các công ty AI lớn này cảm thấy như họ không thực sự kiểm soát được các mô hình này nữa. Và tôi tin rằng điều đó chắc chắn không tốt. Đó là điều mà tất cả chúng ta nên lo lắng.

Tôi thực sự nghĩ rằng một phần lý do tôi hoài nghi về câu chuyện bi quan hoặc chống lại câu chuyện bi quan là vì nó đạt đến mức độ cuồng loạn rằng: “Ồ, điều này có thể tiêu diệt nhân loại trong 10 năm tới.” Nó hơi gây xao nhãng khỏi những tác hại tức thời hơn mà AI có thể gây ra, cho dù đó là liên quan đến lao động, hay liên quan đến môi trường và khí hậu.

Lý tưởng nhất, tôi nghĩ chúng ta nên có thể thảo luận về tất cả những điều này, và có các biện pháp bảo vệ theo quy định và các loại biện pháp bảo vệ khác chống lại tất cả những điều này. Nhưng một khi bạn bắt đầu sử dụng các cụm từ như AGI và siêu trí tuệ, điều đó chỉ hút hết oxy trong phòng theo cách không mấy hữu ích.

Khi bạn mua hàng qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong biên tập của chúng tôi.

Anthony HaEvent Logo
AIĐạo đức AICảnh báo AICông nghệXu hướng
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.