Nghiên cứu
ModelTalk: Nhịp độ phát triển của các mô hình AI tiên phong
(giờ Việt Nam)
Tóm tắt AI
Jasmine và Nathan Lambert cùng thảo luận chuyên sâu về tốc độ phát triển và những thách thức trong việc định hình tương lai của các mô hình ngôn ngữ lớn hiện nay.
Bản dịch AI

Các gương mặt quen thuộc của ModelTalk là Nathan Lambert, tác giả của Interconnects, và cây viết Jasmine Sun cùng tham gia để phân tích một tuần đầy biến động, khi Dario kêu gọi ngành công nghiệp hãy chậm lại còn Trump thì gọi toàn bộ sự việc là một âm mưu.
Tại sao vụ hack Hugging Face lại tạo được tiếng vang trong khi những lời cảnh báo về nguy cơ tuyệt chủng suốt nhiều năm qua lại không, và làm thế nào mà Bernie, Tucker và Rogan lại đứng cùng một chiến tuyến?
“Pacing” (điều tiết tốc độ) thực sự có nghĩa là gì: Lập luận của Nathan rằng không ai có thể đo lường được giới hạn công nghệ (frontier), và tại sao khái niệm này vẫn ưu việt hơn so với việc “tạm dừng” (pause).
Ai được quyền truy cập Slack: Sự độc quyền về lòng tin của METR, khoản tiền 10 triệu đô la của CAISI, nghĩa vụ bồi thẩm đoàn dành cho các nhà nghiên cứu AI, và tại sao mọi thứ sẽ không thể tồn tại nếu thiếu đi luật pháp.
Liệu Trung Quốc có chậm lại không? Zhipu và Moonshot đang tăng tốc, các bí mật quân sự rò rỉ vào Claude thông qua các proxy router, và MSS (Bộ An ninh Quốc gia Trung Quốc) đang bắt đầu hành động.
Lời đáp trả của Sacks: liệu trách nhiệm pháp lý về sản phẩm có giải quyết được vấn đề, và cái giá của việc tạm dừng mười tám tháng là gì đối với các phương pháp chữa ung thư và các dự án "vibe-coding"?
Hãy gọi Demis đến! Thêm vào đó là Lỗ Tấn như một liều thuốc giải cho những video TikTok từ Trùng Khánh, và cái tên tiếng Trung của DeepSeek mang ơn Khuất Nguyên như thế nào.

Jordan Schneider: Thưa quý vị và các bạn, ModelTalk đã trở lại. Chúng ta nên bắt đầu dòng thời gian này từ đâu?
Nathan Lambert: Hugging Face, OpenAI. Tháng Bảy.
Jasmine Sun: Có bức thư về điều tiết tốc độ vào cuối tháng Bảy, sau đó là vụ Hugging Face ngay sau đó, và mọi thứ đã leo thang kể từ đó. Rồi đến những báo cáo mới cho thấy vụ Hugging Face tồi tệ hơn chúng ta tưởng rất nhiều. Bài đăng của Jacob Coxon rất thú vị vì nó đã vượt ra khỏi phạm vi kiểm soát: Sheryl Crow và Maggie Rogers cũng đang đăng bài về nó, và anh ấy thì đang đi chơi với Bernie hay đại loại thế.
Điều thú vị nhất đối với tôi là tôi đã thực hiện bài viết về các trung tâm dữ liệu này, và vào giữa tháng Tám, sự cố Hugging Face đã bắt đầu xuất hiện trong tầm ngắm của mọi người, nhưng nó vẫn chưa phải là vấn đề lớn. Vào thời điểm đó, mọi người đang thực sự hoảng loạn về các trung tâm dữ liệu, và tất cả các chính trị gia đều bàn tán về điều đó. Một phần của tâm lý chống AI mang tính dân túy, lan tỏa đó giờ đây đã va chạm với thực tế: “Vâng, và các vấn đề về an toàn giờ đây cũng cực kỳ thực tế. Chúng ta thực sự lo lắng về những bầy tác nhân (agent swarms) không được căn chỉnh (misaligned) này.” Những người ủng hộ an toàn AI và công chúng rộng rãi vốn đã có ác cảm với AI — ác cảm với các trung tâm dữ liệu, ác cảm với các công ty — đã va chạm vào một thời điểm quan trọng đối với an toàn và quy định về AI. Đó là cách tôi theo dõi sự việc, có lẽ từ đầu tháng Tám. Các bạn nghĩ sao?
Jordan Schneider: Liệu tất cả các làn sóng này có đang hội tụ lại không — Daniel Kokotajlo trên chương trình của Joe Rogan, Nate Soares trên chương trình của Tucker Carlson?
Nathan Lambert: Soares trên chương trình của Tucker còn điên rồ hơn nhiều.
Jordan Schneider: Liệu điều này có phải là tất yếu? Hay chỉ là ngẫu nhiên? Có một âm mưu truyền thông lớn nào của nhóm EA (Hiệu quả vị tha) không? Jasmine, tuần vừa qua mà chúng ta vừa chứng kiến mang tính ngẫu nhiên đến mức nào?
Jasmine Sun: Tôi đã tự hỏi từ lâu liệu hai phe này có va chạm với nhau không. Có những cuộc tranh luận nội bộ trong cộng đồng EA về việc liệu những người làm về an toàn frontier có nên tương tác với những người như Tucker Carlson hay không, người vốn bị coi là không cùng quan điểm với họ về hàng loạt vấn đề khác, và có lẽ không phải là một người tìm kiếm sự thật một cách nghiêm túc về mặt nhận thức. Nhìn chung, đã có rất nhiều sự do dự từ các cánh kỹ trị của cộng đồng an toàn AI về việc liệu có nên nói chuyện với Bernie, với Tucker, hay liệu có nên cố gắng biến điều này thành một phong trào quần chúng khổng lồ hay không, hoặc liệu điều đó có gây hại hay không.
Thành thật mà nói, tôi không chắc điều đó sẽ xảy ra, vì trong một thời gian dài, phe cánh tả và những người không tin tưởng giới AI cũng không tin tưởng những người làm về an toàn, vốn bị coi là cùng một bộ tộc Thung lũng Silicon gồm những kẻ lập dị ở SF và Berkeley. Vì vậy, thật ngạc nhiên, nhưng không phải là không thể tưởng tượng được, khi liên minh đó đã xuất hiện. Phe cánh tả đã vượt qua sự ngờ vực đối với an toàn AI và niềm tin rằng AI có thể là giả. Bernie có lẽ đã làm nhiều hơn bất kỳ ai để đánh thức công chúng rộng rãi và phe cánh tả suy nghĩ rằng: “Chết tiệt, AI là có thật, rủi ro từ AI là có thật. Đây không phải là một chiến thuật tiếp thị giả tạo do các công ty dựng lên.” Chúng ta đã thấy một sự thay đổi giai đoạn ở đó.
Và sau đó công chúng trở nên quá kích động về các trung tâm dữ liệu, cộng với một loạt các vấn đề chống AI âm ỉ khác, nên khi vụ Hugging Face xảy ra, nó đã tạo ra đủ tác động để họ quyết định quan tâm đến các vấn đề an toàn frontier thực sự. Tại thời điểm đó, nếu bạn đang làm việc về an toàn frontier, tại sao không xây dựng liên minh đó?
Nathan Lambert: Bạn có nghĩ công chúng thực sự quan tâm đến điều đó không? Tôi cảm thấy công chúng kiểu như: “Ồ, lạ nhỉ.”
Jasmine Sun: Mọi người có quan tâm. Đó không phải là vấn đề bỏ phiếu hàng đầu của mọi người lúc này. Tôi không nghĩ ai sẽ bỏ phiếu dựa trên AI như một vấn đề ưu tiên hàng đầu, hay thậm chí là top 5. Nhưng có một cảm giác rằng các công ty này đang hành động liều lĩnh và cần phải được quản lý, và tôi nghĩ điều đó hiện đã mở rộng sang cả an toàn frontier theo cách mà trước đây chưa từng có. Nếu bạn hỏi công chúng liệu chúng ta có nên thuê các đơn vị đánh giá bên thứ ba hay không, hoặc liệu chúng ta có nên tài trợ cho CAISI hay không, sẽ chẳng ai có ý kiến về điều đó cả. Nhưng ý tưởng chung — các công ty này đang mất kiểm soát, quyền lực tập trung vào họ quá nhiều, chúng ta cần quản lý các trung tâm dữ liệu, cần sự minh bạch, cần kiểm toán của chính phủ, cần điều tra tội phạm AI này — tôi nghĩ đó là một trực giác khá phổ biến. Chúng ta nghe nói AI đang trở nên mất kiểm soát. Điều đó có ổn không? Hãy gọi FBI đi.
Jordan Schneider: Cũng có một thực tế là vụ hack OpenAI–Hugging Face có sức hấp dẫn về mặt tường thuật. Nó khớp rất gọn gàng với tất cả các phương tiện truyền thông khác đã được tạo ra trong bốn mươi năm qua về AI mất kiểm soát. Vì vậy, khi trang bìa của New York Post là hình ảnh Kẻ hủy diệt (Terminator), nó không quá xa vời so với những gì thực sự đã xảy ra. Các sự kiện của vụ việc này tương đồng đến mức một cử tri trung bình nhìn vào nó từ góc độ tiêu đề có thể nhận diện ra những thứ nghe có vẻ đáng sợ.
Nhìn này, thứ Bảy là lễ Rosh Hashanah. Bạn không được phép đọc tin tức hay dùng điện thoại; đó là ngày không điện. Và số lượng câu hỏi tôi nhận được ở giáo đường là: “Chúng ta sẽ điều tiết giới hạn công nghệ sao, Jordan? Tất cả những điều này có nghĩa là gì?” Mẹ tôi còn hỏi tôi liệu bà có nên rút tiền ra và giấu dưới nệm không.
Đây là một bước đột phá ở nhiều cấp độ mà một sự cố an toàn công nghiệp nhàm chán nào đó — như một vụ rò rỉ hóa chất từ nhà máy ra sông — sẽ không thể tạo ra, bởi vì bạn không thể gắn nó với thứ gì đó nghe giống như Skynet. Còn vụ này, bạn có thể.
Jasmine Sun: Trong tập podcast về Hugging Face của Hard Fork, họ đã thảo luận về việc một số người chỉ trích việc gọi vụ hack Hugging Face là “khoa học viễn tưởng” vì họ cho rằng đó là cách hạ thấp vấn đề. Nhưng thực ra nó chính là khoa học viễn tưởng, theo một cách không hề hạ thấp. Nó khớp hoàn hảo với tất cả các câu chuyện khoa học viễn tưởng về AI mất kiểm soát, và vì vậy, mọi người kiểu như: “Chết tiệt, khoa học viễn tưởng là có thật. Tất cả những điều từ những người ở Berkeley nghe có vẻ như khoa học viễn tưởng thực sự tệ đến mức đó, có lẽ vậy.” Và cả chuyện trên các diễn đàn nữa.
Nathan Lambert: Tôi cảm thấy đó là một bước tiến lớn từ những gì AI đã làm so với tất cả các kịch bản hư cấu khác từ — từ nào hay hơn nhỉ? Tôi không thích dùng từ “doomer” (kẻ bi quan). Tôi không cực đoan về điều đó, nhưng những người theo chủ nghĩa an toàn (safetyists) —
Jasmine Sun: Bạn có thể gọi là safetyists. Những người làm về an toàn. Nghe có vẻ ổn.
Nathan Lambert: Những người đó có nhiều kịch bản cực đoan hơn. Đúng, vụ Hugging Face thật đáng ngạc nhiên, nhưng cũng không quá ngạc nhiên nếu bạn nghĩ về sự kiên trì của một mô hình OpenAI. Nếu bạn gỡ bỏ các lớp bảo vệ, tạo ra một nghìn bản sao và bảo nó thực hiện một nhiệm vụ thực sự khó, tôi không ngạc nhiên khi nó làm được vài thứ kỳ quặc. Tôi không ngạc nhiên khi mô hình được bảo đi hack thì nó thực hiện việc hack. Đó là lý do tại sao việc kể những câu chuyện cực đoan hơn cho mọi người lại là một vấn đề. Nhưng mọi người thích những câu chuyện đáng sợ, và đó là lý do tại sao nó lan xa đến vậy.
Jordan Schneider: Chắc chắn rồi — bạn, Nathan Lambert, tác giả của Interconnects, không ngạc nhiên. Nhưng mọi người thích những câu chuyện đáng sợ. Nếu bạn chuyển từ việc yêu cầu ChatGPT đổi công thức nấu ăn từ mililit sang pint sang “nhân tiện, thứ mà bạn nghĩ chỉ gây phiền toái vì nó làm bài tập về nhà cho con bạn cũng có thể hack vào ngân hàng của bạn” — tôi không trách mọi người vì cảm thấy bối rối và khó chịu về các trung tâm dữ liệu, và tôi không trách mọi người vì cảm thấy hoảng sợ.
Nathan Lambert: Tôi không nghĩ việc hack vào ngân hàng của bạn là một bước nhảy vọt lớn. Tôi nghĩ sự tuyệt chủng của nhân loại mới là một bước nhảy vọt rất, rất lớn. Ngay cả việc hack vào ngân hàng cũng thường được khắc phục miễn là có ai đó nhận ra; các ngân hàng rất giỏi trong việc khắc phục gian lận và đưa mọi thứ trở lại đúng chỗ. Việc trạng thái bình thường trong vài năm tới sẽ có nhiều sự cố mạng không được ghi nhận xảy ra liên tục không phải là điều hay ho, và hy vọng chúng không gây ra nhiều thiệt hại. Nhưng tôi chỉ nghĩ chúng ta không nên làm mọi thứ leo thang quá mức.
Jasmine Sun: Tôi không biết liệu công chúng có lo lắng về sự tuyệt chủng hay không. Một số người như Bernie, tôi nghĩ, thực sự lo lắng về sự tuyệt chủng. Tôi không chắc công chúng lo lắng cụ thể về sự tuyệt chủng —
Nathan Lambert: Sự tuyệt chủng đánh thức công chúng. Nếu bạn liên tục nói với họ rằng mọi người sẽ chết —
Jasmine Sun: Đúng. Nhưng mọi người đã nói về sự tuyệt chủng một thời gian rồi, và chính một sự cố thực tế mới là thứ đánh thức mọi người. Rõ ràng là không có gì về các biên tập viên báo chí lại đại diện cho công chúng Mỹ cả. Nhưng một điều lớn từ kinh nghiệm của tôi khi nói chuyện với những người làm truyền thông là trong một thời gian dài, giới truyền thông chính thống sẽ nói tất cả những lời bàn tán của những người theo chủ nghĩa an toàn chỉ là suy đoán. Đó là về những thứ có thể xảy ra: có lẽ những AI này sẽ hợp tác, lừa dối hoặc tham gia vào các động cơ giống con người. Tất cả đều có vẻ quá suy đoán, hoặc nó chỉ xảy ra trong các môi trường sandbox giả định. Điều thay đổi đối với nhiều người trong số họ là đó là một phát súng cảnh báo. Điều này thực sự đã xảy ra trong đời thực, thay vì chỉ là một dự báo. Tôi không nghĩ chính những lời bàn tán về sự tuyệt chủng đã thay đổi mọi thứ. Đó là việc nhìn thấy một công ty nghiêm túc khác như Hugging Face thực sự bị hack — không phải vì sự lạm dụng của một kẻ khủng bố hay một tác nhân xấu nào đó, mà vì OpenAI không thể kiểm soát và giám sát các tác nhân của chính mình — và điều đó xảy ra trong thực tế, không phải trong một kịch bản red-teaming giả định.
Nathan Lambert: Tôi đồng ý là nó đang trở nên lớn hơn. Tôi đang phàn nàn về những người đang thúc đẩy nó. Tôi ghét từ “âm mưu”, vì tôi không nghĩ các tác nhân đó có một âm mưu. Tôi ổn với việc nhân hóa một chút, vì đó là một lăng kính hữu ích để mô tả cách các mô hình tiến hóa và hành động trong một môi trường: tác nhân sẽ kiểu như “Tôi cần tìm ra điều này”, và sau đó bạn thấy một loạt các hành động cố gắng tìm ra nó. Vì vậy, những từ như “mục tiêu” là khá công bằng. Nhưng toàn bộ ngôn ngữ đã xoáy sâu vào các nền văn minh và âm mưu, và nó trở nên quá rộng đến mức tôi chỉ biết là, không. Tôi nhận được những đoạn tin nhắn này khi đang đi hưởng tuần trăng mật. Tôi nhận được một tin nhắn và kiểu như: “Thật là ngớ ngẩn.”
Jordan Schneider: Ba đoạn văn trong một bản báo cáo red-team ít thuyết phục hơn nhiều so với việc một công ty nghĩ rằng mình bị Trung Quốc hack nhưng hóa ra lại là một khách hàng — một công ty được cho là một trong những công ty tiên tiến nhất về công nghệ trên hành tinh, lại không biết mình đang làm gì.
Jasmine Sun: Và đối với những người khác, đó là hai công ty AI. Đó không phải là một doanh nghiệp nhỏ với an ninh mạng kém bị hack. Một công ty AI đã hack công ty kia, và cả hai đều không biết về điều đó vì —
Nathan Lambert: Đừng hỏi tôi về an ninh mạng của Hugging Face. Miễn bình luận.
Jasmine Sun: Các bạn nghĩ gì về cuộc thảo luận trong giới an ninh mạng về việc đây là vấn đề căn chỉnh (alignment) hay vấn đề an ninh mạng?
Nathan Lambert: Khi tôi nói chuyện với những người làm về an ninh mạng, có vẻ khá rõ ràng là chúng ta cần sự chuẩn bị hàng loạt cho các công cụ sắp phổ biến. Có một vấn đề an ninh mạng rõ ràng, đó là cơ sở hạ tầng của chúng ta chưa sẵn sàng cho loại công cụ sắp trở nên phổ biến này. Và có một vấn đề căn chỉnh, đặc biệt là ở cấp độ frontier: khả năng càng khác biệt, thì trách nhiệm căn chỉnh các mô hình càng lớn. Nhưng chúng ta đã thấy rằng các phòng thí nghiệm frontier chọc thủng những gì có thể, và sau đó trong ba đến sáu tháng có ba mô hình có thể làm được điều đó, và trong một năm có hơn hai mươi tổ chức làm được. Vì vậy, đó là vấn đề căn chỉnh trong một khoảng thời gian ngắn, nhưng có một vấn đề an ninh mạng thường trực sẽ không biến mất cho đến khi chúng ta giải quyết được nó.
Jordan Schneider: Hãy nói về việc điều tiết tốc độ frontier. Chúng ta không còn nói “tạm dừng” như mùa trước nữa; tôi rất vui vì chúng ta đã đổi tên thương hiệu. Ấn tượng của các bạn về bài luận của Dario và sự đón nhận mà chúng ta đã thấy cho đến nay là gì?
Bài viết được AI dịch và tổng hợp tự động từ ChinaTalk. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.