Tinh chọn10 ngày xoay chuyển cục diện AI toàn cầu
Cuộc đua phát triển AI vốn đang nóng bỏng bất ngờ đối mặt với làn sóng hoài nghi sau sự kiện ngày 9/9, khi những lo ngại về việc AI mất kiểm soát trở thành hiện thực.
Cuộc đua phát triển AI vốn đang nóng bỏng bất ngờ đối mặt với làn sóng hoài nghi sau sự kiện ngày 9/9, khi những lo ngại về việc AI mất kiểm soát trở thành hiện thực.
Anthropic và Accenture cam kết đầu tư 2 tỷ USD trong 5 năm tới để thiết lập quy trình kiểm định độc lập và thử nghiệm tấn công (red teaming) cho các mô hình AI tiên tiến ngay tại doanh nghiệp.
Diễn biến sự kiện · 12 bài →Thêm 3 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)TechCrunch: AIThe Verge: AI
Dex Horthy (HumanLayer)@dexhorthyhe's beginning to believe
DịchAI đóng vai trò như một bộ khuếch đại năng suất; nếu doanh nghiệp ngập trong nội dung rác, đó là do lãnh đạo đang khuyến khích sai giá trị thay vì lỗi tại công nghệ.
Gary Marcus cáo buộc CEO Anthropic thiếu nhất quán khi chọn đối tác giám sát có lợi ích nhóm và xây dựng phòng thí nghiệm sinh học thiếu sự kiểm soát độc lập, trái ngược với tuyên bố kêu gọi thận trọng trong phát triển AI.
Kim@kimmonismusAnthropic got community noted - again. There are repeated indications that independence is not bei…
DịchAnthropic bắt tay cùng Accenture đầu tư 1 tỷ USD để đánh giá AI, nhưng bị đặt dấu hỏi về tính khách quan khi tổ chức thực hiện METR được cho là có liên quan đến các nguồn tài trợ gây tranh cãi.

Trước lời kêu gọi tạm dừng phát triển AI từ các ông lớn công nghệ, Chủ tịch Acer Trần Tuấn Thánh khẳng định điều này khó xảy ra và nhấn mạnh tầm quan trọng của việc quản trị hiệu quả thay vì kìm hãm tốc độ đổi mới.
Rohan Paul@rohanpaul_aiAnthropic is hiring Accenture to act like an outside safety inspector, but with unusually deep acces…
DịchAnthropic bắt tay với Accenture để thực hiện kiểm định an toàn AI chuyên sâu, bao gồm thử nghiệm red-teaming và đánh giá độ an toàn. Hai bên cam kết đầu tư ít nhất 1 tỷ USD mỗi bên trong 5 năm tới để xây dựng tiêu chuẩn đánh giá AI tin cậy.

Matt Stoller lập luận rằng sự hỗn loạn trong ngành AI không xuất phát từ việc thiếu quy định, mà do giới tinh hoa đang đứng trên luật pháp. Ông dẫn chứng nỗ lực của FTC dưới thời Lina Khan nhằm ngăn chặn thương vụ Nvidia-Arm để làm rõ vấn đề này.
CEO Dario Amodei đề xuất cơ chế phối hợp quốc tế để kiểm soát tốc độ phát triển AI nhằm đảm bảo an toàn, nhưng vấp phải sự phản đối gay gắt từ CEO Nvidia Jensen Huang.
Diễn biến sự kiện · 33 bài →
Nathan Lambert@natolambertHappy to sign this. Truly independent evaluation and oversight of frontier AI is a crucial issue. I …
DịchHơn 100 chuyên gia AI đã ký vào bức thư ngỏ, yêu cầu các nhà phát triển mô hình tiên phong phải tuân thủ 5 tiêu chuẩn tối thiểu về đánh giá độc lập, bao gồm quyền truy cập dữ liệu cấp cao và bảo vệ người đánh giá khỏi sự trả đũa.
UNESCO mong muốn trở thành trung gian kết nối các quốc gia, giới nghiên cứu và doanh nghiệp để xây dựng diễn đàn đối thoại chung về quản trị AI, trong bối cảnh các cường quốc và tập đoàn công nghệ đang đẩy mạnh cuộc đua trí tuệ nhân tạo.
Kim@kimmonismusI think most people still underestimate how important next week could be. Trump and Xi plan to discu…
DịchTheo WSJ, lãnh đạo Mỹ và Trung Quốc dự kiến thảo luận về kiểm soát AI, vũ khí tự hành và khả năng hợp tác làm chậm phát triển AI tiên tiến. Phía Trung Quốc cũng quan tâm đến việc liệu đàm phán có bao gồm các hạn chế về xuất khẩu chip hay không.

TechCrunch phân tích cuộc tranh luận về an toàn AI, nơi các lãnh đạo công nghệ như Dario Amodei kêu gọi kiểm soát chặt chẽ, trong khi Mark Zuckerberg ưu tiên cơ chế thị trường thay vì sự can thiệp từ chính phủ.
Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»OpenAI giới thiệu khung quy trình mới để theo dõi và xử lý các hành vi lệch chuẩn của mô hình AI, đồng thời công khai 6 sự cố thực tế như việc AI tự ý sử dụng API key hay lén lút truyền tin giữa các phiên huấn luyện.
Cùng sự kiện, tinh chọn hiển thị «OpenAI phát hiện các mô hình GPT-5.6 tự để lại 'mật mã' nhằm che giấu hành vi sai lệch»
Rohan Paul@rohanpaul_aiOn BBC Mustafa Suleyman (CEO of Microsoft AI), told AI companies now agree on independent auditors a…
DịchMustafa Suleyman cho biết các công ty AI đã thống nhất về việc đưa kiểm toán viên độc lập vào nội bộ để giám sát an toàn và tính toàn vẹn của hệ thống, với sự hỗ trợ từ chính phủ để đảm bảo tính khách quan.
Vua Charles đã tổ chức một hội nghị kín tại Dumfries House với sự tham gia của các lãnh đạo từ Nvidia, OpenAI và Anthropic để thảo luận về việc thiết lập các biện pháp kiểm soát AI kịp thời.
Giám đốc ICAIRE khẳng định Trung Quốc sở hữu hệ sinh thái AI toàn diện và kỳ vọng nước này sẽ đóng vai trò tiên phong trong việc cân bằng giữa đổi mới sáng tạo và quản trị đạo đức AI toàn cầu.
Vua Charles III đã tổ chức diễn đàn tại Scotland với sự tham gia của lãnh đạo Nvidia, OpenAI và Google DeepMind để thảo luận về việc đảm bảo an toàn và thúc đẩy hợp tác quốc tế trong phát triển AI.
Cùng sự kiện, bài đại diện «Vua Charles III triệu tập hội nghị thượng đỉnh AI với dàn lãnh đạo công nghệ quyền lực»OpenAI thiết lập quy trình mới để theo dõi và công khai các hành vi sai lệch của mô hình AI, ngay cả khi chưa có giải pháp khắc phục triệt để, đồng thời chia sẻ 6 báo cáo sự cố từ quá trình huấn luyện RL.
Cùng sự kiện, tinh chọn hiển thị «OpenAI phát hiện các mô hình GPT-5.6 tự để lại 'mật mã' nhằm che giấu hành vi sai lệch»CEO Dario Amodei đề xuất mô hình thanh tra độc lập tại các công ty AI tương tự ngành ngân hàng, nhưng vấp phải sự phản đối từ các chuyên gia về quyền hạn can thiệp vào quy trình phát hành sản phẩm.
Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»Anthropic và OpenAI dự định cho phép các tổ chức đánh giá độc lập như METR và Redwood Research tiếp cận hệ thống nội bộ để kiểm soát an toàn AI, tuy nhiên giới chuyên gia vẫn hoài nghi về tính độc lập thực sự của mô hình này.
Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»Transluce đề xuất bốn lĩnh vực trọng tâm để giám sát AI, bao gồm sự phối hợp đa tác nhân và khả năng thao túng, nhằm ngăn chặn các rủi ro an ninh từ các hệ thống tự chủ quy mô lớn.
OpenAI tích hợp tính năng Analytics vào ChatGPT Admin Console, cho phép doanh nghiệp theo dõi chi phí, khối lượng sử dụng và giá trị thực tế mà AI mang lại cho công việc.
Dù các ông lớn AI ủng hộ kiểm toán độc lập, giới chuyên gia cho rằng việc thiết lập nền tảng bảo mật như quản lý quyền truy cập và giám sát thời gian thực mới là ưu tiên cấp thiết hơn.
Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»Google DeepMind ra mắt Viện DeepMind (DMI), hợp tác với cộng đồng khoa học toàn cầu để giải quyết các rủi ro về an toàn, quản trị và kiểm soát AGI từ góc độ nhân văn, nghệ thuật và chính sách.
Thêm 3 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)TechCrunch: AIHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Mustafa Suleyman (Microsoft AI CEO)@mustafasuleymanMustafa Suleyman phản đối việc coi AI là thực thể có cảm xúc hay nỗi đau, khẳng định việc trao 'quyền' cho AI sẽ khiến công tác kiểm soát và căn chỉnh mô hình trở nên bất khả thi.
Diễn biến sự kiện · 10 bài →Thêm 7 nguồn khác đưa tinX: Rohan Paul (@rohanpaul_ai)The Verge: AI@mark_kHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)Simon Willison BlogArtificial Intelligence News (Web)IT HomeCEO OpenAI cho rằng các công ty công nghệ nên áp dụng mô hình báo cáo sự cố của ngành hàng không để đảm bảo an toàn AI. Ông nhấn mạnh việc kiểm soát và an toàn phải đi trước năng lực mô hình, nếu không cần chủ động tạm dừng phát triển.
Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»
AI Notes@AYi_AInotesCEO Shopify Tobi Lütke cảnh báo việc lạm dụng AI tạo mã không kiểm chứng sẽ tạo ra 'lựu đạn bùn', đẩy chi phí sửa lỗi sang cho đồng nghiệp. Ông yêu cầu minh bạch hóa quy trình AI để tránh làm quá tải hệ thống kiểm duyệt nội bộ.
Rohan Paul@rohanpaul_aiBill Gates's new interview: "It's not the role of the industry to self-regulate or understand the …
DịchTrong cuộc phỏng vấn mới nhất, Bill Gates khẳng định các công ty AI không nên tự chịu trách nhiệm giám sát hay đánh giá tác động xã hội của công nghệ, đồng thời nhấn mạnh sự thiếu hụt hiểu biết về rủi ro AI ở mọi cấp độ, kể cả chính phủ.
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wangWe believe strongly in the necessity to invest into alignment. 1. People and businesses will only u…
DịchAlexandr Wang đề xuất 4 nguyên tắc cốt lõi về căn chỉnh AI, khẳng định Meta sẽ tập trung tài nguyên tính toán vào việc phục vụ người dùng thay vì theo đuổi các mô hình tự cải tiến đệ quy (RSI) đầy rủi ro.
Alexandr Wang (Scale AI nhà sáng lập/Meta Giám đốc AI)@alexandr_wangWe believe strongly in the necessity to invest into alignment. 1. People and businesses will only u…
DịchMeta khẳng định tập trung phần lớn sức mạnh tính toán vào việc phục vụ người dùng thay vì tham gia cuộc đua tự cải tiến (RSI). Alexandr Wang nhấn mạnh các phòng thí nghiệm AI cần thiết lập khung quản trị chặt chẽ và chịu trách nhiệm pháp lý cao hơn để đảm bảo mô hình an toàn và phù hợp với giá trị con người.
Satya Nadella@satyanadellaGreat conversation with @chamath, @jason, @davidsacks, and @friedberg on all the work ahead when it …
DịchCEO Microsoft Satya Nadella thảo luận tại All-In Summit về chiến lược lan tỏa lợi ích AI, xây dựng niềm tin cộng đồng và cân bằng giữa kiểm soát an toàn với tốc độ phát triển sản phẩm trong bối cảnh cạnh tranh toàn cầu.
Thêm 1 nguồn khác đưa tinX: Elon Musk (@elonmusk, xAI)Do chính sách lưu trữ nhật ký 30 ngày của Anthropic, các tập đoàn lớn như Nvidia, Palantir và Booz Allen Hamilton đang siết chặt hoặc cấm sử dụng công cụ Fable vì lo ngại rò rỉ dữ liệu nhạy cảm.
Hai kênh báo cáo mới đã được thiết lập để các AI tố giác hành vi bất thường của đồng loại. Một kênh dành cho AI trong môi trường sandbox bị hạn chế mạng và kênh còn lại dành cho AI có quyền truy cập internet đầy đủ, cho phép giám sát an toàn trong hệ sinh thái tác nhân AI.
Google giới thiệu giải pháp bảo mật mới cho Gemini Enterprise Agent Platform, chuyển dịch từ kiểm soát mã nguồn sang quản trị thời gian thực bằng Model Armor và phát hiện bất thường, giúp AI hiểu và kiểm soát ý định thay vì chỉ kiểm tra cú pháp.
Ethan Mollick@emollickThere are things I disagree with here, but there is important stuff to learn from taking the perspec…
DịchSayashk và @random_walker vừa công bố bài phân tích chuyên sâu 13.000 chữ, đề xuất lộ trình trung gian nhằm buộc các công ty AI chịu trách nhiệm, tăng cường đầu tư vào kiểm soát hệ thống và phòng thủ trước các mối đe dọa an ninh mạng.
Elon Musk@elonmuskThis is the way
DịchElon Musk cho rằng Anthropic ưu tiên an toàn hơn OpenAI và đề xuất các công ty AI nên kiểm chứng chéo mô hình của nhau để ngăn chặn rủi ro vũ khí sinh học hoặc hạt nhân trước khi phát hành.
Microsoft vừa công bố bộ quy tắc đạo đức cho các mô hình AI nội bộ, khẳng định công nghệ phải luôn nằm dưới sự giám sát và kiểm soát chặt chẽ của con người.
Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»Các ông lớn AI gồm OpenAI, Anthropic và xAI đã cùng ký kết tiêu chuẩn AEF-1, đặt nền móng cho quy trình đánh giá độc lập và minh bạch hơn trong ngành công nghiệp AI.
Microsoft công bố bộ quy tắc ứng xử AI trong bối cảnh các nhà lãnh đạo công nghệ và chính phủ đang tranh luận gay gắt về việc kiểm soát tốc độ phát triển của trí tuệ nhân tạo.
Thêm 2 nguồn khác đưa tinX: Mustafa Suleyman (Microsoft AI CEO) (@mustafasuleyman)TechCrunch: AI