Don't Worry About the Vase (Zvi)
Điểm AI 85/100

Mô hình

AI #187: Cuộc chơi bắt đầu

(giờ Việt Nam)

Tóm tắt AI

Mô hình Opus 5.5 đã chính thức được phát hành vào thứ Ba vừa qua.

Chính văn · Bản dịch AI

AI #187: Coming Into Play

Opus 5.5 đã được phát hành vào thứ Ba. Tôi đã đề cập đến thẻ hệ thống (system card) vào hôm qua và sẽ sớm nói về các khả năng của nó. Theo mọi báo cáo, đây là một mô hình xuất sắc. Có rất nhiều video thú vị do Opus tạo ra đang lan truyền, tôi sẽ đưa chúng vào bài viết đó.

OpenAI đã phát hành Sol và Luna mới, rẻ hơn và cải tiến hơn. Không ai nhắc đến chúng vì sự xuất hiện của Opus 5.5, nhưng đây là những bản nâng cấp quan trọng bên dưới lớp vỏ.

Bernie Sanders và Greg Casar đã chính thức giới thiệu Đạo luật Ngăn chặn Siêu trí tuệ Nhân tạo. Điều đó có nghĩa là chúng ta cần phải đọc (RTFB) nó. Như thường lệ, tôi giữ quan điểm về các dự luật cụ thể cho đến khi có thể đọc chi tiết. MIRI đã làm vậy và ủng hộ dự luật vì nó đối đầu trực diện với mối đe dọa tuyệt chủng. Tôi hy vọng sẽ sớm có bài RTFB.

Tôi đã tách hai nội dung ra khỏi bản tin hàng tuần:

  1. Nội dung về hành trình tìm kiếm các trình đánh giá nhúng (embedded evaluators) phù hợp cùng các câu hỏi và cuộc tấn công liên quan, sẽ trở thành một bài viết riêng.
  2. Một số vấn đề liên quan đến sự liên kết hợp tác (cooperative alignment), có thể sẽ được gộp vào bài viết về phúc lợi mô hình.

Ngoài bài RTFB tiềm năng về dự luật của Sanders, tôi cũng có thể thực hiện một bài podcast đầy đủ về Jensen Huang trên Ezra Klein, nếu thời gian và cảm xúc cho phép.

Ngoài ra, tôi đã cập nhật xong tin tức. Trong phạm vi tin tức cho phép, số lượng bài đăng sẽ giảm xuống (tôi biết, tôi biết) trong vài tuần tới khi tôi chạy đua để hoàn thành một dự án có tác động lớn khác.

Và vâng, chúng ta sẽ tiếp tục gọi AI là AI, và ASI là ASI, cảm ơn rất nhiều.

  1. Về các thuật ngữ Siêu trí tuệ (Superintelligence) và ‘Siêu Trí tuệ’ (Super Intelligence). TYFYATTM.
  2. Các mô hình ngôn ngữ mang lại tiện ích trần tục. Tìm kiếm sự gian lận ngay trước mắt.
  3. Các mô hình ngôn ngữ không mang lại tiện ích trần tục. Nguy cơ gây ra sự cố quốc tế.
  4. Các mô hình ngôn ngữ chỉ có thể làm việc với những gì bạn cung cấp cho chúng. Thông tin cũ kỹ.
  5. Ồ, các bản nâng cấp. GPT-6 Sol và Luna, Grok 4.7, MiMo-v2.6-Pro.
  6. Vào vị trí. Các AI vượt qua ngưỡng cơ bản của con người trong các dự đoán trên Metaculus.
  7. Kết nối tôi với đại diện của tôi. Đừng để Muse trở thành nàng thơ của bạn.
  8. Thị trấn Deepfake và Ngày tận thế Bot sắp đến. Các nhà phê bình văn học không có gu.
  9. Vui vẻ với việc tạo nội dung truyền thông. Kiến thức về tương lai được phân bổ không đồng đều.
  10. Đối đầu bản quyền. Vụ kiện NYT vs. OpenAI đã được công khai. Một số chi tiết khó coi.
  11. Thiếu an ninh mạng. Mistral bị hack, theo cáo buộc. Những bên khác chắc chắn đã bị hack.
  12. Ôm lấy Hugging Face. Các tác nhân bất hảo của OpenAI đã hack Úc.
  13. Hack vào OpenAI. Ba hacker mũ trắng với Opus 5 đã hack vào OpenAI.
  14. Họ đã cướp mất công việc của chúng ta. Chưa ai thấu hiểu những gì sắp xảy ra.
  15. Tham gia ngay. Derek Thompson đang tuyển một nhà sản xuất mạng xã hội bán thời gian.
  16. Anthropic có một phòng thí nghiệm ướt và một kỹ thuật chỉnh sửa gen tiềm năng. Ồ tốt quá.
  17. Giới thiệu. Computer-10, Agi.fyi, Astra for Law.
  18. Trong các tin tức AI khác. Nhiều người tại các phòng thí nghiệm và UK AISI đang kiệt sức.
  19. Cho tôi thấy tiền đâu. Harvey trở nên đủ tốt để sử dụng, làm hỏng biên lợi nhuận của chính nó.
  20. Bong bóng, bong bóng, lao động và rắc rối. AOC về việc liệu các phòng thí nghiệm AI có quá lớn để sụp đổ không.
  21. Anthropic tiếp cận khả năng tự cải thiện đệ quy. Bạn đã thấy lo lắng chưa?
  22. Những bên khác tiếp cận khả năng tự cải thiện đệ quy. OpenAI và z.AI cũng vậy.
  23. Gánh nặng chứng minh. OpenAI hiện đang nắm giữ hơn 100 kết quả toán học.
  24. Nhanh lên, không còn thời gian nữa. Chúng ta đang tiến rất gần đến lộ trình cho AI 2027.
  25. Người Mỹ cánh tả thực sự ghét AI vì những lý do khác nhau. Những lý do kỳ lạ.
  26. Thành phố Chip. Andy Masley có một bài viết trên The Atlantic.
  27. Nhấc điện thoại lên. Sẽ có một chiếc điện thoại (ảo) mới để nhấc máy.
  28. Tuần lễ âm thanh. Jensen trên Ezra Klein, tôi trên Pushkin, Altman, Soares.
  29. Mọi người chỉ nói những điều họ muốn.
  30. Venkatesh Rao ngừng viết. Ý tưởng giờ đây sẽ được thể hiện qua AI. Tôi rất buồn.
  31. Lời kêu gọi kiểm soát các mô hình AI tiên phong. Nhiều quốc gia đang ký kết.
  32. Lời kêu gọi điều tiết tốc độ phát triển tiên phong. Ban biên tập NYT, Tao, Fukuyama.
  33. Vấn đề chống độc quyền. OpenAI và Anthropic đã tiến gần đến một thỏa thuận thử nghiệm.
  34. Vấn đề trách nhiệm pháp lý. Các phòng thí nghiệm AI phải chịu trách nhiệm cho các tác hại. Họ đồng ý.
  35. Tìm kiếm các quy định hợp lý. Trump cởi mở với các rào cản an toàn AI.
  36. Đổi mới trong hùng biện. Mọi người quay lại sống dưới bóng tối của sự tuyệt chủng.
  37. Gõ vào biển báo. Chỉ có một số lượng biển báo hạn chế.
  38. Một vấn đề gây tranh cãi. Ai sẵn sàng hoặc háo hức tranh luận với ai?
  39. Astra rất khó giám sát. Điều này vượt xa Chuỗi suy nghĩ (Chain of Thought) của nó.
  40. Không thể dự đoán những gì một trí tuệ thông minh hơn có thể làm. Mọi người vẫn cứ hỏi.

Donald Trump, không hài lòng với Vịnh Mỹ và Hồ Mỹ, đã quyết định tuyên bố rằng từ nay về sau Trí tuệ Nhân tạo sẽ được gọi là ‘Siêu Trí tuệ’.

Không. Blog này sẽ tiếp tục gọi AI là AI, hoặc Trí tuệ Nhân tạo.

Việc trở thành Tổng thống không thực sự cho bạn quyền thay đổi cách tiếng Anh vận hành.

Đây cũng là cơn ác mộng tồi tệ nhất về xung đột không gian tên mà ông ấy có thể tạo ra.

Nếu Trump chọn theo các lựa chọn thăm dò ban đầu của mình và quyết định gọi nó là ‘Trí tuệ Cực hạn’, ‘Trí tuệ Ưu việt’ hoặc ‘Trí tuệ Tối cao’, hoặc có lẽ là ‘Trí tuệ Mỹ’ hay ‘Trí tuệ Trump’ hay bất cứ thứ gì, thì đó sẽ là một trò đùa rất hài hước. Tôi sẽ đùa rất nhiều về điều đó.

Thay vào đó, Trump đã chọn thuật ngữ dành cho ‘một AI giỏi hơn tất cả mọi người trong mọi việc’.

Vì vậy, bây giờ, những người sử dụng cả thuật ngữ siêu trí tuệ (superintelligence) và thuật ngữ Siêu Trí tuệ (Super Intelligence) sẽ cùng nói rằng AI đó thông minh hơn họ, nhưng vì những lý do khác nhau.

Do đó, tôi tuyên bố rằng từ nay về sau:

Nếu ai đó sử dụng thuật ngữ Siêu Trí tuệ (hoặc ‘SIÊU TRÍ TUỆ’) dưới dạng nhiều từ, hoặc sử dụng các chữ cái viết tắt SI, thì điều này có nghĩa là AIMAGA, hay ‘Trí tuệ Nhân tạo làm cho nước Mỹ vĩ đại trở lại’. SIMAGA cũng có thể chấp nhận được.

Nếu ai đó sử dụng thuật ngữ siêu trí tuệ (hoặc Siêu trí tuệ) dưới dạng một từ duy nhất, hoặc cụm từ Siêu trí tuệ Nhân tạo, hoặc các chữ cái viết tắt ASI, thì điều này đề cập đến ‘Trí tuệ Nhân tạo thực hiện được gần như tất cả mọi việc tốt hơn con người’.

Nếu bạn đang nói bằng lời, sao cho khoảng dừng có thể bị tưởng tượng hoặc bỏ lỡ, thì hiện tại hãy thêm từ ‘nhân tạo’ hoặc sử dụng các chữ cái viết tắt ASI để tránh nhầm lẫn.

Nếu bạn dùng thuật ngữ AGI, hay Trí tuệ Nhân tạo Tổng quát, sẽ chẳng ai hiểu bạn đang nói gì, nhưng điều đó chẳng liên quan gì đến thông báo của Trump cả. Tiếp tục thôi.

Cảm ơn sự quan tâm của bạn đối với vấn đề này.

Trao cho bất kỳ ai khả năng tạo các báo cáo chuyên sâu về những vấn đề như gian lận PPP. Chúng ta vẫn chưa thấy được tác động mà những thông tin như vậy có thể gây ra.

Thúc đẩy năng suất trong R&D vật liệu mới lên ước tính gấp 10 lần. Ước tính này đến từ Xiaomi, nên hãy cứ hoài nghi, nhưng tôi không nghi ngờ về sự tăng tốc đáng kể này. Họ cho rằng điều này nhờ vào mô hình MiMo-v2.6-Pro của họ, trong khi tôi sẽ nói rằng 'ngay cả MiMo cũng có thể mang lại' mức tăng trưởng này.

Gây nguy cơ xảy ra một sự cố quốc tế lớn bằng cách báo cáo sai cho quân đội Mỹ rằng một con tàu Trung Quốc đang vận chuyển các thành phần vũ khí hạt nhân. May mắn thay, trước khi chiến dịch diễn ra, họ đã kiểm tra và nhận ra AI đã xác định sai vật liệu. CNN gọi đây là một 'ảo giác' (hallucination) nhưng với tôi, đây giống một lỗi sai hơn.

CNN cũng nói rằng điều này 'suýt gây ra chiến tranh', điều này đã phóng đại quá mức. Mỹ và Trung Quốc không sắp sửa xảy ra chiến tranh toàn diện chỉ vì một con tàu bị khám xét nhầm.

Katie Bo Lillis, Zachary Cohen (CNN): “Các công cụ nội bộ phần lớn chỉ là bản sao của các sản phẩm thương mại được tô vẽ thêm,” một cựu quan chức cấp cao của Mỹ am hiểu về các hệ thống AI được quân đội và các nhà phân tích tình báo sử dụng [cho biết].

Phần đó chẳng có gì đáng ngạc nhiên. Cách AI đang được thực tế sử dụng bởi Pete ‘Chủ nghĩa Mỹ không phải Vị tha Hiệu quả’ ‘AI trong mọi thứ hiện nay’ Hegseth và Bộ Chiến tranh có lẽ đang làm tăng khả năng xảy ra một sự cố như vậy. Chúng ta không biết đây là AI nào.

Jon Stokes cảnh báo chúng ta hãy cẩn thận đừng để bị thao túng tâm lý bởi LLM đang bơm thổi bạn. Anh ấy nghĩ rằng mình được bảo vệ phần nào khỏi điều này vì anh ấy không có lợi ích tài chính trong những gì mình đang làm và coi nó như một trò chơi điện tử, nhưng tôi nghĩ anh ấy quan tâm đến những gì mình đang làm và đó là một phần lý do tại sao vấn đề cứ tiếp diễn.

Bloomberg đã công bố một phân tích về việc ‘chuỗi tiêu diệt’ (kill chain) của Mỹ đã gặp lỗi nhắm mục tiêu dẫn đến việc phá hủy một ngôi trường ở Iran, làm ít nhất 123 trẻ em thiệt mạng. Mọi chuyện bắt đầu từ thông tin tình báo lỗi thời. Địa điểm này nhiều năm trước từng là một khu quân sự, nhưng rõ ràng nó đã được chuyển đổi mục đích và bắt đầu hoạt động công khai như một ngôi trường vào năm 2018. AI (Maven thông qua Claude) đã được cung cấp thông tin tình báo lỗi thời và trả lời tương ứng. Sau đó, phần còn lại của chuỗi đã thất bại trong việc thực hiện nhiệm vụ phát hiện những sai sót như vậy.

Krishna Karra (Bloomberg): Bên trong Centcom, đơn vị thực hiện cuộc tấn công của Mỹ, một số nhân sự đã quá phụ thuộc vào trí tuệ nhân tạo được tích hợp trong Maven Smart System, các quan chức cho biết. … Một phát ngôn viên của Palantir cho biết công ty “không chịu trách nhiệm về dữ liệu cơ sở cũng như việc xác định các thiếu sót về tình báo” và không có bằng chứng nào cho thấy phần mềm của họ có lỗi trong cuộc tấn công ở Minab. … Sau cuộc tấn công ở Minab, Palantir đã xây dựng các khả năng mới vào Maven để “rà soát lại thông tin tình báo cơ sở nhằm xác định các yếu tố có thể loại bỏ mục tiêu và gắn cờ các điểm không nhất quán và thiếu chính xác mà con người có thể đã bỏ sót,” theo một người am hiểu vấn đề. Công việc đó đã phát hiện ra một số điểm bất thường, người này cho biết.

Các lỗi chồng chất. Phân tích của AI là rác vào thì rác ra. Việc đánh giá nhắm mục tiêu dân sự đã không được thực hiện. Các đánh giá của con người sau đó cũng thất bại. Sau đó, Hegseth đã che đậy các sai sót, bài báo cho biết, để tránh phản ứng dữ dội tiềm tàng đối với Maven và việc áp dụng AI, và thực tế là họ đã ém nhẹm báo cáo này trong nhiều tháng.

Vấn đề dường như là AI đã làm cho quy trình nhanh hơn và hiệu quả hơn đáng kể, nhưng Hegseth đã cắt giảm chi tiêu cho con người trong việc đảm bảo an toàn còn nhiều hơn thế, và họ đã tấn công hơn 1.000 mục tiêu trong 24 giờ đầu tiên.

Các quan chức tham gia cuộc điều tra đã chỉ ra những lỗ hổng mà họ cho là còn sót lại sau khi Hegseth giải thể hầu hết các đơn vị giảm thiểu tác hại dân sự (CHM) của Lầu Năm Góc — cắt giảm nhân sự ở một số nhóm khoảng 90% xuống còn dưới 20 nhân viên, những người có kiến thức trực tiếp về vấn đề này cho biết. Nhóm của Centcom đã bị giảm từ 10 xuống còn 1 người. Không có thành viên nào của nhóm CHM kiểm tra địa điểm Minab trước khi cuộc tấn công diễn ra, theo các quan chức tham gia cuộc điều tra nội bộ.

Maven đã thực hiện công việc được yêu cầu. Sai lầm nằm ở việc coi kết quả đó là đáng tin cậy hơn nhiều so với thực tế dựa trên dữ liệu đầu vào, và cắt giảm 90% các nhóm sửa lỗi và giảm thiểu tác hại. Nhiều người kỳ vọng Maven sẽ gắn cờ các hồ sơ cũ, nhưng đó không phải là một phần trong phạm vi công việc được giao của nó.

Đây là một kiểu thất bại phổ biến và nguy hiểm. Khi hệ thống nhanh hơn, rẻ hơn và đáng tin cậy hơn so với con người ở cùng một bước đó, bạn sẽ bị cám dỗ cắt giảm các yếu tố hạn chế khác và loại bỏ con người khỏi quy trình. Hãy hết sức cẩn thận khi làm điều đó.

GPT-6 Sol và GPT-6 Luna đã ra mắt. Sol có giá $2/$10, Luna có giá $0.10/$0.50, giảm giá 50% cho cả dòng Sol và Luna. Astra vẫn là mô hình mạnh nhất của OpenAI, vì vậy theo quy ước, Sol sẽ không được bao phủ toàn diện. Nó và Luna vẫn có vẻ là những mô hình rất tốt ở mức giá của chúng, ít nhất là cho đến khi chúng ta thấy Sonnet 5.5 và Haiku 5.5.

Họ vẫn đang sử dụng luận điệu ‘được căn chỉnh tốt hơn’ (more aligned):

OpenAI: GPT‑6 Sol và Luna được xây dựng dựa trên những tiến bộ của Astra về khả năng căn chỉnh, cho thấy những cải tiến so với các phiên bản GPT-5.6 tương ứng.

Bài gốc còn tiếp — xem tiếp tại bài gốc ↗

Bài viết được AI dịch và tổng hợp tự động từ Don't Worry About the Vase (Zvi). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

AI #187: Cuộc chơi bắt đầu | AIHOT.vn