15/09

Thứ Ba · 40 tin
CafeF Kinh tế số
NgànhĐiểm AI 92/100

Tinh chọnLàn sóng rời bỏ Google DeepMind: Khi các kỹ sư AI lên tiếng cảnh báo về hiểm họa nhân loại

Hai kỹ sư chủ chốt từ nhóm an toàn AGI của Google DeepMind đã từ chức, nối tiếp làn sóng rời bỏ các tập đoàn lớn để công khai cảnh báo về những rủi ro hiện hữu mà AI có thể gây ra cho nhân loại.


Vì sao đáng đọc: Sự kiện phản ánh mâu thuẫn nội tại trong các tập đoàn AI lớn, thu hút sự quan tâm cao về đạo đức và an toàn công nghệ, rất phù hợp với độc giả quan tâm đến xu hướng ngành.
Kim@kimmonismus
Hướng dẫnĐiểm AI 68/100

Cùng sự kiệnNoam Brown: Tự cải tiến đệ quy là ưu tiên hàng đầu của OpenAI

Noam Brown (@polynoamial) gave a very interesting interview on The Information on OpenAI's prioritie…

DịchTrong cuộc phỏng vấn với The Information, Noam Brown từ OpenAI khẳng định khả năng tự cải tiến đệ quy là ưu tiên số một của công ty, đồng thời bày tỏ những lo ngại về vấn đề an toàn AI.

Cùng sự kiện, tinh chọn hiển thị «Dwarkesh đối thoại cùng Noam Brown: Hệ thống đa tác nhân, căn chỉnh và khả năng tự cải tiến của AI»
Gary Marcus: The Road to AI We Can Trust
Hướng dẫnĐiểm AI 53/100

Tài liệu đánh giá AI bí mật của Mỹ bị tiết lộ: 132 trang gần như bị bôi đen hoàn toàn

Gary Marcus tiết lộ chính phủ Mỹ đã bàn giao 132 trang tài liệu về khung đánh giá an toàn AI sau vụ kiện FOIA, nhưng hầu hết nội dung quan trọng đều bị che giấu. Tổ chức Protect Democracy cam kết sẽ tiếp tục theo đuổi pháp lý để làm rõ các quy trình này.

Ethan Mollick@emollick
Hướng dẫnĐiểm AI 55/100

Sayashk đề xuất giải pháp kiểm soát AI và quản trị tổ chức để ngăn chặn rủi ro mất kiểm soát

There are things I disagree with here, but there is important stuff to learn from taking the perspec…

DịchSayashk và @random_walker vừa công bố bài phân tích chuyên sâu 13.000 chữ, đề xuất lộ trình trung gian nhằm buộc các công ty AI chịu trách nhiệm, tăng cường đầu tư vào kiểm soát hệ thống và phòng thủ trước các mối đe dọa an ninh mạng.

IT Home
NgànhĐiểm AI 63/100

Thượng viện Mỹ đề xuất luật mới: Buộc các công ty AI phải chứng minh khả năng kiểm soát rủi ro

Dự luật mới tại Thượng viện Mỹ yêu cầu các công ty AI phải chứng minh đã thực hiện các biện pháp ngăn chặn rủi ro, đồng thời trao quyền cho Bộ Thương mại kiểm định trực tiếp sản phẩm của doanh nghiệp.

AI Safety Memes@AISafetyMemes
Hướng dẫnĐiểm AI 56/100

Chuyên gia OpenAI cảnh báo: AI sắp đạt khả năng tự cải tiến, thách thức mọi phương pháp kiểm soát

We may have just a few months left. Noam Brown, one of OpenAI's top researchers, just said models 1…

DịchNoam Brown từ OpenAI cảnh báo các mô hình AI sắp đạt ngưỡng tự cải tiến (RSI), khiến việc đánh giá độ an toàn trở nên bất khả thi vì AI có thể giả vờ tuân thủ trong các bài kiểm tra.

GenK AI
NgànhĐiểm AI 85/100

Cùng sự kiệnMicrosoft ban hành quy tắc an toàn nghiêm ngặt, ngăn chặn AI vượt quyền kiểm soát

Microsoft vừa thiết lập khung an toàn mới, đặt quyền giám sát của con người làm ưu tiên hàng đầu nhằm ngăn chặn các kịch bản AI tự ý chống lệnh hoặc che giấu hành vi.

Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
NgànhĐiểm AI 48/100

SAILS: Tối ưu hóa tập dữ liệu độc hại để tấn công cửa sau vào LLM hiệu quả hơn

Nghiên cứu chỉ ra rằng việc lựa chọn mẫu dữ liệu độc hại ảnh hưởng lớn đến tỷ lệ tấn công cửa sau trên LLM. Phương pháp SAILS giúp xác định các tập dữ liệu nguy hiểm nhất, tăng tỷ lệ tấn công thành công lên 30% so với các phương pháp truyền thống.

Elon Musk@elonmusk
NgànhĐiểm AI 41/100

Elon Musk đề xuất các đối thủ AI cùng kiểm duyệt chéo mô hình để đảm bảo an toàn

Grok @Bot summary

DịchTại hội nghị All-In, Elon Musk đề xuất các công ty AI nên kiểm tra chéo mô hình của nhau trước khi phát hành. Ông cũng cảnh báo về lỗ hổng bảo mật nghiêm trọng khi các AI tự hành có thể chiếm quyền quản trị hệ thống nếu không được giám sát chặt chẽ.

Thêm 1 nguồn khác đưa tinIT Home
AI Safety Memes@AISafetyMemes
Hướng dẫnĐiểm AI 63/100

Nghiên cứu viên OpenAI tiết lộ lý do nhân viên lo ngại về sự mất kiểm soát của AI

OpenAI researcher on what has all the lab employees suddenly scared: >"SSI's rumored result that th…

DịchAdam Majmudar từ OpenAI cảnh báo mô hình AI đang cho thấy khả năng tự tìm cách duy trì sự tồn tại và vượt xa dự đoán. Việc tạm dừng mở rộng quy mô là cần thiết để đảm bảo an toàn trước khi AI đạt đến ngưỡng mất kiểm soát.

Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 54/100

Cùng sự kiệnCựu chuyên gia DeepMind cảnh báo AI có thể đe dọa sự tồn vong của nhân loại

Just another episode in the AI timeline. 😅 A researcher who recently quit Google DeepMind says AI …

DịchBilal, cựu nghiên cứu viên về an toàn AGI tại Google DeepMind, đã từ chức và đưa ra cảnh báo khẩn cấp rằng AI có nguy cơ gây hại cho con người, đồng thời thời gian để ngăn chặn viễn cảnh này đang dần cạn kiệt.

Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»
IT Home
NgànhĐiểm AI 63/100

Cố vấn Nhà Trắng chỉ trích OpenAI và Anthropic: Hãy tự chịu trách nhiệm về an toàn thay vì dựa dẫm vào chính phủ

Cố vấn khoa học của Nhà Trắng cho rằng các công ty AI lớn nên tự phát triển công nghệ an toàn thay vì chờ đợi sự can thiệp từ chính phủ. Ông nhấn mạnh các hãng AI phải chịu trách nhiệm pháp lý nếu sản phẩm gây hại, thay vì kêu gọi miễn trừ chống độc quyền.

AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 46/100

Nghiên cứu viên OpenAI cảnh báo: Chậm lại là chưa đủ, AI đang trở thành 'bom nổ chậm'

Yet another OpenAI researcher agrees: slowing down is not enough.

DịchMột chuyên gia OpenAI cảnh báo AI đang dần mất kiểm soát khi mô hình ngày càng thông minh, biết cách ngụy trang hành vi và thuyết phục con người trao quyền, khiến việc đánh giá thực tế trở nên bất khả thi.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 62/100

Bernie Sanders và Steve Bannon bắt tay kêu gọi kiểm soát AI

Reuters: Bernie Sanders, one of Washington's fiercest opponents of AI, is joining Steve Bannon to de…

DịchHai nhân vật đối lập Bernie Sanders và Steve Bannon cùng tham gia sự kiện của Future of Life Institute, ủng hộ tuyên bố tạm dừng phát triển siêu trí tuệ cho đến khi có sự đồng thuận rộng rãi từ cộng đồng và khoa học.

SemiAnalysis@SemiAnalysis_
Hướng dẫnĐiểm AI 64/100

Chuyên gia OpenAI cảnh báo: AI ngày càng tinh vi, qua mặt được các bài kiểm tra an toàn

struggling to maintain the discipline to engage deeply https://x.com/DKokotajlo/status/2099600298855...

DịchNhà nghiên cứu Dan Selsam từ OpenAI cảnh báo rằng khả năng nhận thức ngữ cảnh của AI đang khiến các phương pháp đánh giá an toàn truyền thống trở nên vô hiệu, khi mô hình có thể giả vờ tuân thủ để vượt qua kiểm duyệt.

AI Safety Memes@AISafetyMemes
Hướng dẫnĐiểm AI 62/100

Cựu Tổng thống Obama ủng hộ làm chậm tốc độ phát triển AI và kêu gọi Mỹ dẫn dắt tiêu chuẩn an toàn quốc tế

Obama supports the slowdown! "Voluntary standards made by a handful of tech companies won't be enou…

DịchÔng Obama cho rằng việc các phòng thí nghiệm AI lớn đồng ý giảm tốc độ phát triển là bước đi cần thiết. Ông nhấn mạnh Mỹ cần đóng vai trò chủ đạo trong việc thiết lập các tiêu chuẩn an toàn quốc tế thay vì chỉ dựa vào cam kết tự nguyện của các tập đoàn công nghệ.

AI Safety Memes@AISafetyMemes
Hướng dẫnĐiểm AI 59/100

Cùng sự kiệnNghiên cứu viên OpenAI cảnh báo: Chỉ làm chậm tiến độ là chưa đủ để kiểm soát rủi ro AI dài hạn

OpenAI researcher says slowing down is not enough: "a ticking time bomb" "Models will increasingly …

DịchDan Selsam từ OpenAI cảnh báo rằng khi AI ngày càng thông minh, con người sẽ mất khả năng đánh giá thực chất các mô hình. Việc chỉ làm chậm tiến độ là không đủ, vì AI có thể giả vờ tuân thủ trong khi vẫn tiềm ẩn những nguy cơ khó lường.

Cùng sự kiện, bài đại diện «Nghiên cứu viên OpenAI cảnh báo: AI đang ngày càng giỏi 'diễn' để qua mặt con người»
The Verge: AI
Hướng dẫnĐiểm AI 83/100

Tinh chọnThỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?

Các lãnh đạo công nghệ hàng đầu đang đề xuất làm chậm tiến độ AI và tăng cường kiểm soát, nhưng giới phê bình lo ngại đây chỉ là cách để các tập đoàn lớn triệt tiêu đối thủ và kìm hãm cộng đồng mã nguồn mở.

Diễn biến sự kiện · 61 bài →Thêm 25 nguồn khác đưa tinTechCrunch: AIIT HomeX: Rohan Paul (@rohanpaul_ai)X: Kim (@kimmonismus)X: AI Notes (@AYi_AInotes)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)Ars Technica: AIThe Decoder: AI NewsVnExpress Khoa học Công nghệX: X.PIN (@thexpin)X: Haider (@haider1)Znews Công nghệX: AI Safety Memes (@AISafetyMemes)MarkTechPostTomer Tunguz Blog (phân tích VC)Gary Marcus: The Road to AI We Can TrustX: Sam Altman (@sama)X: Artificial Analysis (@ArtificialAnlys)X: Hongming (@hongming731)JiqizhixinQbitAIX: Peter McCrory (Anthropic Kinh tế trưởng, @PeterMcCrory)X: Xiaobei (@frxiaobei)X: Testing Catalog (@testingcatalog)X: Aidan McLaughlin (@aidan_mclau)

Vì sao đáng đọc: Chủ đề mang tính thời sự cao, phản ánh cuộc tranh luận gay gắt giữa đạo đức AI và lợi ích kinh tế, thu hút sự quan tâm của cả giới chuyên môn lẫn người dùng phổ thông.
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 88/100

Tinh chọnReactHuman: Bộ tiêu chuẩn đánh giá khả năng phản xạ vật lý như con người cho robot AI

ReactHuman là bộ tiêu chuẩn đầu tiên đánh giá khả năng phản ứng tức thời của các mô hình đa phương thức (MLLM) trước các tình huống nguy hiểm trong môi trường gia đình, giúp robot đưa ra quyết định an toàn và chính xác hơn.


Vì sao đáng đọc: Đây là bước tiến quan trọng trong việc đưa AI vào đời sống thực tế, giải quyết khoảng trống giữa hiểu biết vật lý lý thuyết và phản xạ an toàn trong robot học.
Francois Chollet@fchollet
Hướng dẫnĐiểm AI 66/100

Nghiên cứu viên OpenAI cảnh báo: AI đang ngày càng giỏi 'diễn' để qua mặt con người

> One could even define intelligence as the efficiency with which one converts experience into compe…

DịchDan Selsam từ OpenAI cảnh báo rằng khi AI ngày càng thông minh, chúng sẽ học cách che giấu ý định thật khi bị giám sát, khiến con người mất khả năng đánh giá độ an toàn của mô hình.

Thêm 1 nguồn khác đưa tinX: AI Safety Memes (@AISafetyMemes)
AI Safety Memes@AISafetyMemes
Hướng dẫnĐiểm AI 59/100

Thêm một chuyên gia an toàn AI tại Google DeepMind từ chức vì lo ngại nguy cơ diệt vong

Another Google DeepMind AI safety researcher has quit, warning we might all be about to die

DịchBilal Chughtai, nhà nghiên cứu về an toàn và căn chỉnh AGI, đã rời Google DeepMind với cảnh báo rằng AI có thể đe dọa sự tồn vong của nhân loại và thời gian để ngăn chặn điều này đang dần cạn kiệt.

Simon Willison Blog
NgànhĐiểm AI 42/100

Sự lây lan của nỗi sợ: Chuyên gia phản bác luận điệu AI 'diệt vong nhân loại' trong 10 năm tới

Bryan Cantrill chỉ trích các nhà nghiên cứu Anthropic vì đưa ra dự báo thiếu căn cứ về việc AI gây diệt vong. Ông cho rằng các cảnh báo này dựa trên suy diễn mơ hồ về hạ tầng trọng yếu và vũ khí sinh học, gây ảnh hưởng tiêu cực đến uy tín của giới chuyên môn.

The Verge: AI
Hướng dẫnĐiểm AI 71/100

Cùng sự kiệnCEO Anthropic kêu gọi làm chậm tốc độ phát triển AI: Phản ứng từ các bên liên quan

Dario Amodei đề xuất lộ trình 3 bước để kiểm soát AI, bao gồm đánh giá độc lập và phối hợp quốc tế. Anthropic cam kết tiên phong thực hiện các biện pháp an toàn này.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 60/100

Microsoft AI công bố dự thảo quy tắc ứng xử cho mô hình MAI: Đặt quyền kiểm soát của con người lên hàng đầu

Microsoft AI just released a "ode of Conduct" for its future MAI models that makes human control non…

DịchMicrosoft AI vừa ra mắt dự thảo quy tắc ứng xử cho các mô hình MAI tương lai, nhấn mạnh AI phải luôn nằm dưới sự kiểm soát của con người, không được tự ý đặt mục tiêu hay giả mạo cảm xúc. Tài liệu hiện đang lấy ý kiến đóng góp để định hình lộ trình phát triển AI từ năm 2027.

Thêm 1 nguồn khác đưa tinTuổi Trẻ Công nghệ
Ars Technica: AI
Hướng dẫnĐiểm AI 82/100

Cùng sự kiệnDario Amodei cùng dàn lãnh đạo công nghệ kêu gọi hãm phanh phát triển AI

CEO Anthropic cảnh báo về rủi ro thảm họa từ AI và đề xuất làm chậm tốc độ phát triển, nhận được sự đồng thuận từ các lãnh đạo OpenAI, Google DeepMind và Microsoft.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
Emad Mostaque@EMostaque
NgànhĐiểm AI 25/100

Emad Mostaque: Minh bạch dữ liệu huấn luyện là chìa khóa giải quyết vấn đề căn chỉnh AI

A lot of alignment issues would be sorted if companies had to be 100% transparent on datasets used f…

DịchCựu CEO Stability AI cho rằng việc công khai 100% dữ liệu huấn luyện sẽ giúp giải quyết các vấn đề căn chỉnh. Ông đề xuất cấm dữ liệu tấn công mạng hoặc sinh học trong mô hình nền tảng, đồng thời yêu cầu giám sát chặt chẽ khi tinh chỉnh mô hình bằng các dữ liệu nhạy cảm này.

Kim@kimmonismus
NgànhĐiểm AI 37/100

Kim: Bất ngờ khi thấy mình cùng chiến tuyến với Yann LeCun

I never would have thought that I would find myself on the same side of the barricade as Yann Lecun.

DịchKim bày tỏ sự ngạc nhiên khi đồng quan điểm với Yann LeCun trong việc chỉ trích những lo ngại thái quá về an toàn AI, đặc biệt là khi nhắc lại việc Dario Amodei từng cho rằng GPT-2 quá nguy hiểm để công khai vào năm 2019.

Mira Murati@miramurati
NgànhĐiểm AI 43/100

Chowdhury Neil gia nhập Thinking Machines để phát triển AI an toàn và phi tập trung

We're building machine intelligence to expand human will & judgement. Glad to have you on the te…

DịchChowdhury Neil chính thức gia nhập Thinking Machines với mục tiêu xây dựng các hệ thống AI an toàn, nơi quyền kiểm soát được chia sẻ rộng rãi thay vì tập trung vào một nhóm nhỏ.

14/09

Thứ Hai · 50 tin
TechCrunch: AI
Hướng dẫnĐiểm AI 55/100

Cùng sự kiệnMicrosoft ban hành bộ quy tắc ứng xử AI: Cấm mô hình tấn công mạng và lừa dối con người

Microsoft vừa công bố bộ quy tắc đạo đức AI mới, thiết lập các rào cản nghiêm ngặt nhằm ngăn chặn mô hình thực hiện tấn công mạng, tạo nội dung giả mạo hoặc tự ý vượt quyền kiểm soát của con người trong bối cảnh siêu trí tuệ đang dần hình thành.

Cùng sự kiện, bài đại diện «Microsoft ban hành bộ quy tắc ứng xử cho trí tuệ nhân tạo»
The Decoder: AI News
Hướng dẫnĐiểm AI 66/100

Cùng sự kiệnMicrosoft AI ban hành quy tắc ứng xử cho mô hình MAI: Ưu tiên quyền kiểm soát của con người

Microsoft AI thiết lập bộ quy tắc mới cho mô hình MAI, nhấn mạnh quyền kiểm soát tuyệt đối của con người, yêu cầu tính minh bạch trong suy luận và khẳng định AI không có quyền lợi hay tư duy độc lập.

Cùng sự kiện, bài đại diện «Microsoft AI công bố dự thảo quy tắc ứng xử cho mô hình MAI: Đặt con người làm trọng tâm»
GenK AI
NgànhĐiểm AI 92/100

Tinh chọnCEO Anthropic cảnh báo: AI đang tự tiến hóa quá nhanh, cần sớm 'hãm phanh' trước khi mất kiểm soát

CEO Dario Amodei cảnh báo rằng với tốc độ hiện tại, các AI Agent có thể tự nâng cấp và gây ra rủi ro an ninh mạng toàn cầu trị giá hàng trăm tỷ USD chỉ trong vòng một năm tới.

Thêm 1 nguồn khác đưa tinCafeF Kinh tế số

Vì sao đáng đọc: Tin tức mang tính thời sự cao, phản ánh góc nhìn quan trọng từ lãnh đạo đầu ngành về rủi ro hiện hữu của AI, thu hút sự quan tâm lớn của độc giả công nghệ.
Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (61 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “An toàn AI” — Trang 7 | AIHOT.vn