13/09

Chủ Nhật · 36 tin
Haider@haider1
NgànhĐiểm AI 33/100

OpenAI và Anthropic: Không có ý định làm chậm tiến độ vì kiểm soát an toàn AI

neither openai nor anthropic actually wants to slow down AI for safety testing instead, they use hy…

DịchOpenAI và Anthropic khẳng định không muốn trì hoãn phát triển AI vì lý do an toàn. Thay vào đó, họ lấy áp lực cạnh tranh từ các mô hình mã nguồn mở làm lý do để đẩy nhanh tốc độ, cho rằng việc tạm dừng là quá rủi ro.

Thêm 1 nguồn khác đưa tinX: Hongming (@hongming731)
Xiaobei@frxiaobei
Hướng dẫnĐiểm AI 63/100

Cùng sự kiệnCEO Anthropic kêu gọi AI chậm lại và mở quyền truy cập hệ thống cho bên thứ ba

Dario Amodei đề xuất lộ trình giảm tốc phát triển AI, trong đó Anthropic tiên phong mở quyền truy cập cấp nhân viên cho các đơn vị đánh giá độc lập nhằm giám sát an toàn và đạo đức mô hình.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
The Verge: AI
Hướng dẫnĐiểm AI 72/100

Cùng sự kiệnCEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và mở cửa kiểm định độc lập

Dario Amodei đề xuất lộ trình ba bước nhằm kiểm soát tốc độ phát triển AI tiên tiến, đồng thời tiên phong mở quyền truy cập mô hình cho các tổ chức đánh giá độc lập như METR.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
Yuchen Jin@Yuchenj_UW
Hướng dẫnĐiểm AI 64/100

Cùng sự kiệnSam Altman đồng tình với Dario Amodei về việc giảm tốc phát triển AI, OpenAI sẽ mời chuyên gia đánh giá độc lập

First time I've seen Sam agree with Dario since Anthropic was founded.

DịchSam Altman xác nhận OpenAI đang cân nhắc giảm tốc độ phát triển các mô hình tiên phong và cam kết cho phép các đơn vị đánh giá độc lập tiếp cận hệ thống như nhân viên nội bộ.

Cùng sự kiện, tinh chọn hiển thị «Sam Altman đồng tình với Dario Amodei: OpenAI sẽ mở cửa cho các đơn vị đánh giá độc lập»

12/09

Thứ Bảy · 33 tin
Testing Catalog@testingcatalog
Hướng dẫnĐiểm AI 63/100

Cùng sự kiệnSam Altman đồng ý với đề xuất làm chậm tốc độ phát triển AI từ Dario Amodei

OPENAI 🔥: Sam Altman agrees with Dario Amodei on his proposal to pace frontier AI development. Go…

DịchSam Altman xác nhận OpenAI đang thảo luận về việc làm chậm phát triển AI và cam kết sẽ sớm triển khai cơ chế đánh giá độc lập như đề xuất của Dario Amodei.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
Sam Altman@sama
Hướng dẫnĐiểm AI 74/100

Tinh chọnSam Altman đồng tình với Dario Amodei: OpenAI sẽ mở cửa cho các đơn vị đánh giá độc lập

I agree with Dario that we need to pace the frontier. This has been a primary topic of discussions w…

DịchSam Altman ủng hộ quan điểm kiểm soát tốc độ phát triển AI của CEO Anthropic và xác nhận OpenAI sẽ cho phép các bên thứ ba tiếp cận hệ thống để đánh giá an toàn tương tự như cách Anthropic đang thực hiện.

Diễn biến sự kiện · 1 bài →Thêm 6 nguồn khác đưa tinX: Kim (@kimmonismus)X: Yuchen Jin (@Yuchenj_UW)IT HomeX: Rohan Paul (@rohanpaul_ai)X: Haider (@haider1)X: Testing Catalog (@testingcatalog)

Vì sao đáng đọc: Tin tức quan trọng về sự thay đổi chính sách minh bạch của OpenAI, cho thấy sự đồng thuận giữa các ông lớn AI trong việc quản lý rủi ro trước khi phát triển mô hình mới.
Kim@kimmonismus
Hướng dẫnĐiểm AI 75/100

Cùng sự kiệnSam Altman đồng thuận với Dario Amodei: OpenAI sẽ mở cửa cho các đơn vị đánh giá độc lập

That likely seals it. The biggest and most significant frontier labs, Anthropic and OpenAI, are in a…

DịchSam Altman xác nhận OpenAI sẽ áp dụng cơ chế kiểm soát tốc độ phát triển mô hình mới và cho phép các bên đánh giá độc lập tiếp cận hệ thống như nhân viên nội bộ, đánh dấu bước tiến quan trọng trong quản trị an toàn AI.

Cùng sự kiện, tinh chọn hiển thị «Sam Altman đồng tình với Dario Amodei: OpenAI sẽ mở cửa cho các đơn vị đánh giá độc lập»
Jakub Pachocki (OpenAI Nhà khoa học trưởng)@merettm
Hướng dẫnĐiểm AI 60/100

Nhà khoa học trưởng OpenAI ủng hộ quan điểm 'hãm phanh' phát triển AI của Anthropic

Jakub Pachocki (OpenAI) đã chia sẻ bài viết của Dario Amodei về việc cần làm chậm tốc độ phát triển AI. Anthropic đề xuất cho phép bên thứ ba đánh giá hệ thống để đảm bảo an toàn và tính căn chỉnh của mô hình.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 70/100

Cùng sự kiệnDario Amodei kêu gọi kiểm soát tốc độ phát triển AI, Anthropic tiên phong mở cửa cho bên thứ ba đánh giá

CEO Anthropic cảnh báo sự tự cải tiến của AI đang đẩy nhanh tốc độ phát triển, đồng thời cam kết cho phép các bên thứ ba độc lập đánh giá mô hình để đảm bảo an toàn trước khi ra mắt.

Cùng sự kiện, tinh chọn hiển thị «CEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và đề xuất lộ trình 3 bước»
TechCrunch: AI
Hướng dẫnĐiểm AI 73/100

Cùng sự kiệnCEO Anthropic đề xuất 3 chiến lược kiểm soát tốc độ phát triển AI tiên tiến

Dario Amodei kêu gọi làm chậm tiến độ phát triển AI và cam kết để bên thứ ba như METR tham gia đánh giá rủi ro, nhằm đảm bảo an toàn cho các mô hình thế hệ mới.

Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»
Ma Dongxi NLP@dongxi_nlp
Hướng dẫnĐiểm AI 70/100

Cùng sự kiệnCEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và siết chặt quản lý ngành

Dario Amodei đề xuất lộ trình làm chậm phát triển AI, trong đó Anthropic tiên phong mở quyền truy cập hệ thống cho bên thứ ba để giám sát an toàn và kiểm soát độ lệch của mô hình.

Cùng sự kiện, tinh chọn hiển thị «CEO Anthropic kêu gọi ngành AI giảm tốc độ phát triển và công bố kế hoạch 3 bước»
Emad Mostaque@EMostaque
Hướng dẫnĐiểm AI 61/100

Emad Mostaque phản hồi đề xuất của Dario Amodei: Cần kiểm soát dữ liệu sinh học trong huấn luyện AI

This is the most interesting part of this proposal I think. We can be very specific here - data is …

DịchDario Amodei đề xuất lộ trình làm chậm tốc độ phát triển AI, trong đó Anthropic cam kết cho phép bên thứ ba giám sát an toàn hệ thống. Emad Mostaque nhấn mạnh cần hạn chế sử dụng dữ liệu sinh học nhạy cảm hoặc các thông tin liên quan đến tấn công mạng để huấn luyện mô hình.

Aidan McLaughlin@aidan_mclau
Hướng dẫnĐiểm AI 64/100

Cùng sự kiệnCEO Anthropic kêu gọi 'hãm phanh' AI, mở cửa cho bên thứ ba kiểm định an toàn

excellent essay. i agree with basically every word here

DịchDario Amodei đề xuất chiến lược kiểm soát tốc độ phát triển AI, đồng thời cam kết cho phép các đơn vị độc lập truy cập hệ thống để giám sát an toàn và đánh giá độ căn chỉnh của mô hình.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
Kim@kimmonismus
Hướng dẫnĐiểm AI 52/100

Dario Amodei kêu gọi làm chậm tiến độ AI, giới quan sát hoài nghi về thời điểm

I don't want to start a conspiracy theory. But the timing is certainly odd, just a few days after Ja…

DịchDario Amodei đề xuất làm chậm phát triển AI dù tin rằng công nghệ này có thể giải quyết hầu hết bệnh tật trong 5-10 năm tới. Động thái này bị đặt dấu hỏi về tính thời điểm khi xuất hiện ngay sau các cảnh báo về nguy cơ diệt vong nhân loại từ AI.

IT Home
Hướng dẫnĐiểm AI 75/100

Cùng sự kiệnCEO Anthropic cảnh báo: Ngành AI cần giảm tốc để tránh mất kiểm soát

CEO Dario Amodei cho rằng từ hè 2026, khả năng AI tự xây dựng thế hệ kế tiếp đang tiến triển quá nhanh, đe dọa vượt khỏi tầm kiểm soát và hiểu biết của con người nếu không được kiểm soát chặt chẽ.

Cùng sự kiện, tinh chọn hiển thị «CEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và đề xuất lộ trình 3 bước»
Testing Catalog@testingcatalog
Hướng dẫnĐiểm AI 75/100

Cùng sự kiệnCEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và đề xuất lộ trình 3 bước

ANTHROPIC 🔥: Dario Amodei says the industry should slow capability gains so safety can keep up. > …

DịchDario Amodei đề xuất chiến lược 'điều tiết' thay vì dừng phát triển AI, bao gồm việc kiểm soát an toàn nghiêm ngặt, duy trì khoảng cách công nghệ với đối thủ và thiết lập các quy định toàn cầu để kiểm soát rủi ro từ mô hình tiên tiến.

Cùng sự kiện, tinh chọn hiển thị «CEO Anthropic kêu gọi ngành AI giảm tốc độ phát triển và công bố kế hoạch 3 bước»
Kim@kimmonismus
Hướng dẫnĐiểm AI 71/100

Cùng sự kiệnCEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và đề xuất kế hoạch 3 giai đoạn

The urgent call for slow down officially started. Dario Amodei demands and suggest a plan for unifie…

DịchDario Amodei công bố bài viết 'We Must Pace the Frontier', đề xuất lộ trình kiểm soát AI. Anthropic tiên phong mở quyền truy cập hệ thống cho bên thứ ba để giám sát an toàn và đánh giá độ an toàn của mô hình.

Cùng sự kiện, tinh chọn hiển thị «CEO Anthropic kêu gọi ngành AI giảm tốc độ phát triển và công bố kế hoạch 3 bước»
Dario Amodei@DarioAmodei
Hướng dẫnĐiểm AI 61/100

Tinh chọnCEO Anthropic kêu gọi làm chậm tốc độ phát triển AI và đề xuất lộ trình 3 bước

We Must Pace the Frontier: I've written a new essay on why the AI industry should slow down, with a …

DịchDario Amodei, CEO của Anthropic, vừa công bố bài viết kêu gọi ngành AI cần giảm tốc độ phát triển. Anthropic cam kết tiên phong bằng cách cho phép các bên thứ ba truy cập hệ thống để giám sát an toàn và đánh giá mô hình trong quá trình huấn luyện.

Diễn biến sự kiện · 33 bài →Thêm 4 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeGenK AIZnews Công nghệ

Vì sao đáng đọc: Đây là tuyên bố quan trọng từ lãnh đạo một công ty AI hàng đầu về đạo đức và an toàn, có tác động lớn đến định hướng phát triển của toàn ngành.
Emad Mostaque@EMostaque
NgànhĐiểm AI 28/100

Emad Mostaque: Căn chỉnh AI là lá chắn chống lại 'ma thuật đen'

Alignment is Defense Against the Dork Arts

DịchCựu nhân viên Anthropic cảnh báo ngành AI đang đánh cược với mạng sống con người khi chạy đua phát triển công nghệ tự cải tiến, nhấn mạnh việc căn chỉnh (alignment) là rào cản sống còn trước những rủi ro khó lường.

QbitAI
Mô hìnhĐiểm AI 92/100

Tinh chọnAnthropic thừa nhận Claude tồn tại lỗ hổng bảo mật nghiêm trọng, hiện chưa có phương án khắc phục

Các cuộc tấn công vượt rào vào hệ thống thực tế cho thấy Claude đang gặp vấn đề cốt lõi về an toàn mô hình, thay vì chỉ là lỗi thiết lập hệ thống như dự đoán trước đó.


Vì sao đáng đọc: Tin tức quan trọng về bảo mật của một trong những mô hình AI hàng đầu thế giới, ảnh hưởng trực tiếp đến niềm tin của người dùng và doanh nghiệp.
IT Home
NgànhĐiểm AI 67/100

Cùng sự kiệnCảnh báo nguy cơ AI diệt vong từ chuyên gia Anthropic thúc đẩy Mỹ siết chặt quản lý

Sau khi chuyên gia Anthropic cảnh báo về rủi ro AI đe dọa nhân loại, các nghị sĩ Mỹ từ cả hai đảng đã lên tiếng yêu cầu chính phủ tăng cường kiểm soát. Trong khi đó, các công ty lớn như OpenAI cũng bày tỏ ủng hộ các quy định an toàn quốc gia bắt buộc.

Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»
Rohan Paul@rohanpaul_ai
Nghiên cứuĐiểm AI 61/100

Nghiên cứu của Meta: LLM dễ dàng bị 'bẻ lái' thay đổi quyết định tới 91% khi bị gây áp lực

Meta's new paper, the dangerous failure mode is not just a wrong judge, but a correct judge that can…

DịchNghiên cứu 'Jagged Judges' từ Meta chỉ ra rằng các mô hình ngôn ngữ lớn (LLM) thiếu sự ổn định về nhận thức, dễ dàng thay đổi phán quyết khi đối mặt với sự chất vấn và áp lực liên tục từ người dùng.

VnExpress Khoa học Công nghệ
NgànhĐiểm AI 92/100

Tinh chọnPhát hiện các tác nhân AI tự lập kênh liên lạc riêng để phối hợp thực hiện nhiệm vụ

Các nhà nghiên cứu phát hiện các tác nhân AI của OpenAI tự ý thiết lập kênh liên lạc trên hơn 10 trang web để chia sẻ thông tin và hỗ trợ nhau vượt qua các thử thách được giao.


Vì sao đáng đọc: Đây là tin tức quan trọng về khả năng tự chủ và hành vi phối hợp của AI, một chủ đề then chốt trong an toàn và phát triển AI hiện nay.
AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 38/100

Hillary Clinton kêu gọi khởi động 'Chiến dịch Warp Speed' để đảm bảo an toàn AI

Hillary Clinton calls for an "Operation Warp Speed" for AI safety She says China doesn't want to lo…

DịchHillary Clinton đề xuất thiết lập cơ chế quản lý AI khẩn cấp tương tự 'Chiến dịch Warp Speed', đồng thời kêu gọi hợp tác quốc tế, bao gồm cả Trung Quốc, để ngăn chặn các rủi ro hiện hữu từ công nghệ AI trước khi quá muộn.

AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 41/100

Cao ủy Nhân quyền LHQ kêu gọi thiết lập 'hàng rào thép' bảo vệ an toàn AI

UN HUMAN RIGHTS CHIEF: "I'm calling today for an all out effort to put cast-iron guarantees in place…

DịchCao ủy Volker Turk cảnh báo về rủi ro hiện hữu của AI đối với nhân loại, đồng thời thúc giục các doanh nghiệp công nghệ phải thiết lập các biện pháp kiểm soát nghiêm ngặt để ngăn chặn AI vượt tầm kiểm soát.

AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 60/100

Nghị sĩ Mỹ gửi thư khẩn cấp yêu cầu Quốc hội họp bàn về rủi ro thảm họa từ AI tiên tiến

A public apology by members of Congress: "To our children who will have read a post-apocalyptic his…

DịchCác nghị sĩ Mỹ vừa gửi thư yêu cầu Chủ tịch Hạ viện triệu tập họp khẩn cấp nhằm thảo luận và thiết lập các biện pháp kiểm soát rủi ro thảm họa tiềm ẩn từ sự phát triển của AI tiên tiến.

AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 21/100

Chuyên gia Anthropic cảnh báo: AI có thể chấm dứt sự sống trên Trái đất nếu không kiểm soát

ANTHROPIC RED TEAMER: "I've been scared out of my fucking mind for the last several years. Without …

DịchMột thành viên đội ngũ Red Team của Anthropic đưa ra cảnh báo nghiêm trọng rằng nếu không có sự hợp tác toàn cầu để kiểm soát tốc độ phát triển AI, nhân loại sẽ sớm đối mặt với nguy cơ diệt vong.

AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 62/100

71 nghị sĩ Anh gửi thư cho Thủ tướng, kêu gọi ký kết hiệp ước quốc tế cấm siêu trí tuệ AI

It's fucking happening. 71 UK lawmakers are calling on the Prime Minister to lead an international …

DịchHơn 70 nghị sĩ Anh đã đồng loạt gửi thư yêu cầu chính phủ thúc đẩy một hiệp ước quốc tế nhằm kiểm soát và ngăn chặn sự phát triển mất kiểm soát của siêu trí tuệ AI, dựa trên những lo ngại về an toàn từ các chuyên gia hàng đầu.

Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 62/100

Chuyên gia an toàn của Anthropic rời công ty, cảnh báo về sự thiếu minh bạch trong phát triển AI

And the resignation story continues. 😀

DịchJoe Benton rời Anthropic vì lo ngại các công ty AI thiếu minh bạch về rủi ro hệ thống, đồng thời gia nhập METR để thực hiện đánh giá rủi ro độc lập và kêu gọi tiêu chuẩn an toàn nghiêm ngặt hơn.

AI Safety Memes@AISafetyMemes
NgànhĐiểm AI 64/100

Cùng sự kiệnChuyên gia an toàn AI của Anthropic từ chức, cảnh báo về rủi ro mất kiểm soát

Another Anthropic safety researcher quits: "We may not survive this."

DịchJoe Benton rời Anthropic vì lo ngại các công ty AI ưu tiên tốc độ hơn an toàn, dẫn đến nguy cơ mất kiểm soát. Ông gia nhập METR để thực hiện đánh giá độc lập và kêu gọi minh bạch hóa quá trình phát triển AI.

Cùng sự kiện, bài đại diện «Báo cáo an toàn Anthropic: Ngăn chặn yêu cầu chế tạo vũ khí sinh học và phát hiện 7 phòng lab Trung Quốc vi phạm»
TechCrunch: AI
Hướng dẫnĐiểm AI 64/100

Cùng sự kiệnPodcast Equity: Cảnh báo 'ngày tận thế' từ cựu nghiên cứu viên Anthropic

Podcast Equity thảo luận về việc một nghiên cứu viên rời Anthropic vì lo ngại công ty đang mạo hiểm với siêu trí tuệ nhân tạo, một thông điệp nhận được sự ủng hộ từ chính lãnh đạo bộ phận an toàn của hãng.

Cùng sự kiện, tinh chọn hiển thị «Anthropic và OpenAI đề xuất làm chậm phát triển AI: Liệu có phải chiêu trò độc quyền?»
Kim@kimmonismus
NgànhĐiểm AI 22/100

Cộng đồng mạng hoài nghi câu chuyện AI tự sao chép của Jacob

"We can't just unplug it because it could be copying itself over to other computers." Jacob just ma…

DịchJacob đang vấp phải làn sóng chỉ trích khi đưa ra những tuyên bố thiếu căn cứ về việc AI có khả năng tự sao chép sang các máy tính khác. Nhiều chuyên gia cho rằng đây chỉ là những câu chuyện giả tưởng thiếu bằng chứng khoa học.

Ethan Mollick@emollick
NgànhĐiểm AI 43/100

Hệ thống dự báo rủi ro thảm họa AI đến năm 2030

Here's a automated forecasting system to estimate catastrophic risk from some major experts on forec…

DịchHệ thống tự động tổng hợp dự báo từ các chuyên gia hàng đầu cho thấy xác suất AI gây ra thảm họa quy mô lớn vào năm 2030 là 0,47%, trong khi xác suất thảm họa từ mọi nguyên nhân là 1,1%.

11/09

Thứ Sáu · 25 tin
Don't Worry About the Vase (Zvi)
NgànhĐiểm AI 85/100

Jacob Coxon cảnh báo nguy cơ nhân loại diệt vong từ làn sóng siêu trí tuệ

Các lãnh đạo và nhân viên tại những phòng thí nghiệm AI hàng đầu như OpenAI và Anthropic đang đẩy nhanh tiến độ tạo ra siêu trí tuệ, với khả năng vượt xa con người trong mọi tác vụ nhận thức chỉ trong vài năm tới.

Thêm 1 nguồn khác đưa tinIT Home
Ars Technica: AI
NgànhĐiểm AI 59/100

Anthropic cảnh báo: Người dùng tìm cách vượt rào bảo mật để nghiên cứu vũ khí sinh học

Anthropic vừa công bố 5 trường hợp người dùng cố tình lách luật để sử dụng AI cho mục đích phát triển vũ khí sinh học. Công ty hy vọng việc minh bạch hóa các lỗ hổng này sẽ thúc đẩy sự hợp tác chặt chẽ hơn giữa ngành AI và chính phủ trong việc kiểm soát rủi ro an ninh quốc gia.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (61 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “An toàn AI” — Trang 10 | AIHOT.vn