Tin ngành
AI #186: Thế giới bắt đầu chú ý
(giờ Việt Nam)
Tóm tắt AI
Sau sự kiện Jacob Coxon từ chức và hiệu ứng domino kéo theo, tình hình phát triển AI đang leo thang với tốc độ chóng mặt.
Bản dịch AI

Sau sự kiện Jacob Coxon từ chức và hiệu ứng "preference cascade" (thác đổ ưu tiên) kéo theo sau đó, mọi thứ đã leo thang rất nhanh. Truyền thông chính thống đã bắt đầu vào cuộc.
CEO Dario Amodei của Anthropic đã lên tiếng rằng "Chúng ta phải điều tiết tốc độ phát triển (We Must Pace the Frontier)", đồng thời cam kết sẽ là bên tiên phong thực hiện bước đi đơn phương là đưa các điều tra viên vào nội bộ. OpenAI cũng cam kết thực hiện bước đi tương tự, và hiện tại cả hai công ty cùng với Google đang hợp tác về vấn đề an toàn.
Công chúng đã bắt đầu chú ý, làm tăng mức độ quan tâm về khả năng AI có thể tiêu diệt nhân loại, đồng thời ước tính của mọi người về khả năng xảy ra điều đó đã tăng gần gấp đôi, từ mức trung bình khoảng 15% lên khoảng 30%. Nhiều chính trị gia đã kêu gọi ban hành các quy định, rào cản an toàn và tổ chức các phiên điều trần khẩn cấp tại Quốc hội.
Điều quan trọng nhất đã và vẫn đang là tránh sự phân cực chính trị. Trong suốt quá trình này, tôi sẽ liên tục nhắc nhở các bạn hãy bình tĩnh, rằng các cuộc tấn công nhắm vào Trump hay Đảng Cộng hòa nói chung chỉ làm tình hình tồi tệ hơn, và rằng nhiều người thuộc Đảng Cộng hòa, như tôi đã dẫn chứng hôm qua, đang thức tỉnh và hành động một cách hợp lý, bao gồm cả các phe phái bên trong Nhà Trắng.
Than ôi, hiện tại những người không phù hợp, như David Sacks, Mark Zuckerberg và Jensen Huang, đã thuyết phục được Donald Trump đánh đồng hoàn toàn rủi ro hiện hữu (existential risk) với việc phản đối các trung tâm dữ liệu, và Trump đã coi rủi ro hiện hữu từ AI là một "trò lừa bịp" (Full Hoax).
Ngoài ra còn có một nỗ lực có hệ thống nhằm thực hiện các chiến dịch bôi nhọ nhắm vào tất cả những ai cảnh báo rằng AI có thể gây ra sự diệt vong cho nhân loại, với mục tiêu cụ thể đầu tiên là METR, và một số đòn tấn công khá cực đoan nhắm vào Effective Altruism (Chủ nghĩa vị tha hiệu quả), theo những cách chắc chắn sẽ phản tác dụng nhưng sẽ không mấy dễ chịu đối với những người đang nằm trong tầm ngắm.
Tuần này tôi cũng đã đề cập đến hai sự kiện quan trọng đã xảy ra trước đó: Một mô hình mới giải được bài toán Millennium Prize, và báo cáo của Anthropic về các nỗ lực sử dụng Claude cho mục đích xấu, bao gồm các cuộc tấn công chưng cất dữ liệu (distillation attacks) lừa đảo được thực hiện trên quy mô lớn bởi tất cả các phòng thí nghiệm AI lớn của Trung Quốc, trong đó một vài đơn vị cũng đã âm thầm chuyển lượng lớn dữ liệu người dùng cho Anthropic. Anthropic báo cáo rằng họ đang làm rất tốt việc ngăn chặn các mối đe dọa như vậy, mặc dù tất nhiên chúng ta không biết liệu họ đã bắt được tất cả những kẻ thủ ác hay chưa.
Cuối cùng tôi cũng đã hoàn thành bài đánh giá năng lực cho Astra, một sản phẩm xuất sắc giống như Fable 5.1.
Đây là giai đoạn nước rút. Mọi thứ sẽ ngày càng nhanh hơn, kỳ lạ hơn, đáng sợ hơn và căng thẳng hơn, nhưng tôi hy vọng rằng hai tuần vừa qua là khoảng thời gian đặc biệt nhanh, kỳ lạ, đáng sợ và căng thẳng. Hy vọng chúng ta sẽ sớm có một khoảng lặng tương đối, và tôi có thể có được thứ được coi là một kỳ nghỉ.
Hiện tại trong hàng đợi bài viết, luôn có thể thay đổi do Tin nóng (Breaking News), nhưng đây là những gì sẽ xảy ra nếu tình hình tương đối yên ắng:
Bài viết thứ Sáu sẽ là "The Preference Cascade is Only Getting Started" (Hiệu ứng thác đổ ưu tiên chỉ mới bắt đầu).
Bài viết thứ Bảy sẽ xem xét báo cáo của Anthropic về các sự cố liên kết (alignment incidents) của họ.
Bài viết Chủ nhật sẽ thảo luận về một số vấn đề liên quan đến các quy tắc pháp lý cho lòng trung thành của AI.
Bài viết thứ Hai sẽ là bản tổng hợp hàng tháng.
Tôi rất hy vọng mọi thứ sẽ diễn ra đúng như vậy.
Các mô hình ngôn ngữ mang lại tiện ích trần tục. Sửa máy in và máy rửa bát.
Các mô hình ngôn ngữ không mang lại tiện ích trần tục. Bầu cử là một chủ đề nhạy cảm.
Hả, Nâng cấp. Ứng dụng Gemini cho Windows, Claude Cowork hợp nhất vào trò chuyện.
Vào vị trí. CheatBench.
Deepfaketown và Botpocalypse sắp đến. Làm tràn ngập không gian mạng.
Thiếu an ninh mạng. OpenAI có đội ngũ red team cho Astra và tự sửa chữa hệ thống của mình.
Astra rất khó giám sát. Thượng nghị sĩ Van Hollen có những câu hỏi dành cho OpenAI.
Tham gia. Biểu tình tại DC vào thứ Bảy.
Giới thiệu. Công ty kiểm toán AI mới và Viện DeepMind.
Tin tức AI khác. OpenAI bắt đầu tính phí chính phủ cho các dịch vụ của mình.
Giờ bạn đã biết. Chuyện gì thực sự đã xảy ra với những tuyên bố điên rồ của Andreessen.
Hugging the Face. Các phản ứng và cuộc điều tra vẫn tiếp tục.
Đàn ong các tác nhân OpenAI bất hảo chưa được phát hiện. Vâng, còn nhiều nữa.
Cho tôi thấy tiền. Những cuộc thảo luận về rủi ro hiện hữu của AI đã làm tổn thương một số cổ phiếu và giúp ích cho những cổ phiếu khác.
Những suy đoán thầm lặng. Vâng, có lẽ một số người đã dự đoán gần đúng điều này.
Các quan chức Nhà Trắng cố gắng hành động tỉnh táo. Xác định những kẻ phản diện thực sự.
Đảng Dân chủ phản ứng tỉnh táo trước việc AI có khả năng tiêu diệt mọi người. Bao gồm cả Obama.
Điều tiết tốc độ phát triển. Thêm thông tin đưa tin.
Bài giảng khách mời từ Alex Tabarrok về sự chiếm dụng quy định (Regulatory Capture). Nếu bạn cần.
Mark Zuckerberg đưa ra suy nghĩ. Tôi cho rằng điều này tốt hơn mong đợi?
Megan McArdle về sự không đầy đủ của các khuôn khổ pháp lý hiện tại. Một sự bác bỏ.
Nhấc điện thoại lên. Những gì Trung Quốc đã làm và có thể sớm thực hiện.
Tuần lễ âm thanh. Bạn có rất nhiều lựa chọn. Tôi là một trong số đó.
Mọi người chỉ nói những điều họ muốn.
Bài viết được AI dịch và tổng hợp tự động từ Don't Worry About the Vase (Zvi). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.