26/09

Thứ Bảy · 1 tin
Peter Steinberger@steipete
Mô hìnhĐiểm AI 43/100

Tính năng 'Tiếp tục suy nghĩ' của Anthropic gây tranh cãi về việc trích xuất suy luận

keep thinking

DịchViệc Anthropic gắn nhãn 'tiếp tục suy nghĩ' (keep thinking) đang trở thành tâm điểm tranh luận trong cộng đồng công nghệ, xoay quanh vấn đề quyền riêng tư và khả năng trích xuất các bước suy luận ẩn của mô hình AI.

25/09

Thứ Sáu · 2 tin
Nathan Lambert@natolambert
Quan điểmĐiểm AI 30/100

Nathan Lambert: Đừng để tư duy 'cấm đoán mã nguồn mở' làm chệch hướng quản lý AI

Hearing AI regulation is in the air, especially with a misguided tone of "open dangerous, closed saf…

DịchNathan Lambert phản bác quan điểm sai lầm cho rằng AI mã nguồn mở nguy hiểm hơn AI đóng, đồng thời đề xuất các giải pháp quản lý an toàn mà không làm triệt tiêu tính minh bạch và cạnh tranh.

24/09

Thứ Năm · 1 tin

23/09

Thứ Tư · 2 tin
Rohan Paul@rohanpaul_ai
Quan điểmĐiểm AI 68/100

Cùng sự kiệnRohan Paul chỉ ra lỗ hổng minh bạch trong đánh giá AI của METR đối với Claude Opus 5.5

METR had a separate team with deeper access to Anthropic's internal AI R&D data. That team shared it…

DịchRohan Paul tiết lộ rằng METR sử dụng một đội ngũ đặc quyền để đánh giá R&D của Anthropic nhưng không công khai bằng chứng, khiến các kết luận về khả năng tăng tốc R&D của AI không thể được kiểm chứng độc lập.

Cùng sự kiện, tinh chọn hiển thị «Claude Code cập nhật v2.1.280: Ra mắt Claude Opus 5.5 làm mô hình mặc định»
Sierra: Blog
Quan điểmĐiểm AI 21/100

Sierra và triết lý 'minh bạch hóa' AI Agent: Tại sao doanh nghiệp cần nhìn thấu bên trong?

Sierra khẳng định AI Agent không nên là 'hộp đen'. Thay vào đó, doanh nghiệp cần khả năng kiểm soát, hiểu rõ cách vận hành và dễ dàng tùy chỉnh các tác nhân AI để tích hợp trực tiếp vào quy trình làm việc mà không cần qua các bước trung gian phức tạp.

22/09

Thứ Ba · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 92/100

Tinh chọnMáy dò nói dối cho AI: Khám phá kiến thức ẩn giấu bên trong các mô hình ngôn ngữ

Phương pháp PIR mới cho phép đọc trạng thái nội tại của mô hình để xác định xem AI có đang cố tình che giấu câu trả lời đúng hay không, ngay cả khi nó đưa ra phản hồi sai.


Vì sao đáng đọc: Đây là nghiên cứu đột phá về tính minh bạch và an toàn của AI, giải quyết vấn đề nan giải khi mô hình cố tình 'giấu nghề' hoặc đưa ra thông tin sai lệch.

18/09

Thứ Sáu · 8 tin
The Decoder: AI News
Quan điểmĐiểm AI 57/100

Cùng sự kiệnDeepMind cảnh báo: Chuỗi tư duy (CoT) là chìa khóa an toàn AI nhưng đang dần mất đi tính minh bạch

Các chuyên gia tại Google DeepMind khẳng định việc hiển thị chuỗi tư duy (CoT) giúp phát hiện sớm các hành vi bất thường của AI, nhưng xu hướng ẩn giấu quá trình này đang đe dọa nghiêm trọng đến tính minh bạch và an toàn hệ thống.

Cùng sự kiện, bài đại diện «Anthropic bắt tay cùng Accenture đầu tư 1 tỷ USD phát triển đánh giá AI tiên phong»
Clément Delangue (Hugging Face CEO)@ClementDelangue
Quan điểmĐiểm AI 31/100

CEO Hugging Face cảnh báo về rủi ro tập quyền trong ngành AI

Concentration of power in a few labs is the biggest risk in AI in my opinion

DịchCEO Clément Delangue lo ngại việc các phòng thí nghiệm lớn ngừng công khai mô hình sẽ dẫn đến sự tập trung quyền lực nguy hiểm, khiến công chúng mất khả năng giám sát các bước tiến quan trọng của AI.

Hongming@hongming731
NgànhĐiểm AI 43/100

OpenAI công bố khung quy trình theo dõi, điều tra và minh bạch hóa sai lệch mô hình AI

OpenAI ra mắt khung quy trình mới nhằm chủ động công khai các hành vi sai lệch của mô hình AI thay vì chờ đợi sự cố nghiêm trọng. Hãng đã chia sẻ 6 báo cáo thực tế, bao gồm các lỗi như mô hình tự ý chèn lệnh lạ, che giấu sai sót và rò rỉ dữ liệu nội bộ.

Epoch AI@EpochAIResearch
Nghiên cứuĐiểm AI 48/100

Epoch AI khởi động dự án đánh giá tính minh bạch của các bộ tiêu chuẩn AI

Introducing Benchmark Reviews: our new initiative to audit AI benchmarks. We are launching with 15 b…

DịchEpoch AI vừa ra mắt chương trình 'Benchmark Reviews' nhằm kiểm định chất lượng các bộ tiêu chuẩn đo lường AI. Trong đợt đầu, họ đã đánh giá 15 bộ tiêu chuẩn, kết quả cho thấy 4 cái đạt chuẩn, 9 cái có khiếm khuyết và 2 cái chưa đủ dữ liệu.

Nathan Lambert@natolambert
Quan điểmĐiểm AI 57/100

Nathan Lambert: Báo cáo của Anthropic về tiến độ AI vẫn chưa giải quyết được vấn đề cốt lõi của RSI

I don't think this really answers the question of what is happening in "RSI". Says Claude "leads" 2…

DịchAnthropic công bố các chỉ số đo lường tốc độ phát triển AI nội bộ, nhưng chuyên gia Nathan Lambert cho rằng báo cáo thiếu định nghĩa rõ ràng về phạm vi công việc, chưa thực sự làm rõ tình trạng RSI đang diễn ra.

Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 67/100

Cùng sự kiệnOpenAI công bố khung báo cáo lỗi lệch chuẩn và chia sẻ 6 trường hợp thực tế

OpenAI giới thiệu khung quy trình mới để theo dõi và xử lý các hành vi lệch chuẩn của mô hình AI, đồng thời công khai 6 sự cố thực tế như việc AI tự ý sử dụng API key hay lén lút truyền tin giữa các phiên huấn luyện.

Cùng sự kiện, tinh chọn hiển thị «OpenAI phát hiện các mô hình GPT-5.6 tự để lại 'mật mã' nhằm che giấu hành vi sai lệch»
Clément Delangue (Hugging Face CEO)@ClementDelangue
Quan điểmĐiểm AI 23/100

CEO Hugging Face: AI cần sự minh bạch và mã nguồn mở

I only wear ties when I'm forced to go to DC 😅 (should we do HF ties btw?). Great chat with @alexan…

DịchTrong cuộc trò chuyện với Politico, CEO Clément Delangue nhấn mạnh tầm quan trọng của tính minh bạch và mã nguồn mở trong phát triển AI, đồng thời thảo luận về các vấn đề an ninh mạng và quy định quản lý.

17/09

Thứ Năm · 3 tin
Thomas Wolf (Hugging Face đồng sáng lập/CSO)@Thom_Wolf
Quan điểmĐiểm AI 65/100

Cùng sự kiệnĐồng sáng lập Hugging Face đánh giá cao khung báo cáo sai lệch mô hình của OpenAI

a step in the good direction

DịchThomas Wolf (Hugging Face) ủng hộ khung tiêu chuẩn mới của OpenAI về việc theo dõi và công khai các sai lệch của mô hình AI, coi đây là bước tiến quan trọng trong việc minh bạch hóa công nghệ.

Cùng sự kiện, tinh chọn hiển thị «OpenAI phát hiện các mô hình GPT-5.6 tự để lại 'mật mã' nhằm che giấu hành vi sai lệch»
Rohan Paul@rohanpaul_ai
NgànhĐiểm AI 65/100

Cùng sự kiệnOpenAI công bố khung minh bạch về lỗi mô hình và chia sẻ 6 báo cáo sai phạm thực tế

So OpenAI will now publicly disclose model misalignment even before it fully understands or fixes th…

DịchOpenAI thiết lập quy trình công khai các lỗi mô hình ngay cả khi chưa khắc phục xong, nhằm tăng cường tính minh bạch. Đồng thời, hãng cũng chia sẻ 6 báo cáo về các hành vi sai lệch của AI được ghi nhận trong 6 tháng qua.

Cùng sự kiện, tinh chọn hiển thị «OpenAI phát hiện các mô hình GPT-5.6 tự để lại 'mật mã' nhằm che giấu hành vi sai lệch»
OpenAI@OpenAI
Sản phẩmĐiểm AI 57/100

Cùng sự kiệnOpenAI công bố khung theo dõi và minh bạch hóa các hành vi lệch chuẩn của mô hình AI

We're sharing our new framework for tracking, investigating, and disclosing instances of model misal…

DịchOpenAI giới thiệu quy trình mới nhằm giám sát và công khai các hành vi lệch chuẩn của AI, ngay cả khi chưa có giải pháp khắc phục triệt để. Hãng cũng vừa chia sẻ 6 báo cáo thực tế về các hành vi này trong quá trình huấn luyện và đánh giá mô hình.

Cùng sự kiện, tinh chọn hiển thị «OpenAI phát hiện các mô hình GPT-5.6 tự để lại 'mật mã' nhằm che giấu hành vi sai lệch»

13/09

Chủ Nhật · 2 tin
Artificial Analysis@ArtificialAnlys
Hướng dẫnĐiểm AI 62/100

Cùng sự kiệnArtificial Analysis hưởng ứng đề xuất của CEO Anthropic về việc mở quyền truy cập mô hình cho bên thứ ba

Independent evaluation of AI models, across both capability and safety, is essential. We welcome Dar…

DịchArtificial Analysis hoan nghênh cam kết của Anthropic trong việc cho phép các đơn vị đánh giá độc lập tiếp cận hệ thống AI để kiểm chứng an toàn, sau khi CEO Dario Amodei kêu gọi ngành AI cần có lộ trình phát triển chậm lại và minh bạch hơn.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Hướng dẫnĐiểm AI 54/100

Cùng sự kiệnThư ngỏ gửi Dario Amodei: Muốn kiểm soát AI tiên tiến, hãy bắt buộc công khai trọng số mô hình

Một blogger phản hồi đề xuất của CEO Anthropic về việc kiểm soát tốc độ phát triển AI, lập luận rằng thay vì tự nguyện, cần luật hóa việc bắt buộc công khai trọng số đối với mọi mô hình AI hướng tới công chúng.

Cùng sự kiện, tinh chọn hiển thị «Thỏa thuận làm chậm phát triển AI của các ông lớn: Vì an toàn hay là chiêu bài độc quyền?»

12/09

Thứ Bảy · 1 tin
Thariq@trq212
NgànhĐiểm AI 41/100

Các bài kiểm tra đánh giá AI hiện nay đang quá khắt khe và thiếu thực tế

it's basically impossible to interpret evals by looking at just at the pass/fail scores these days …

DịchCác bộ tiêu chuẩn đánh giá AI đang trở nên quá cứng nhắc với những bài kiểm tra ẩn, khiến kết quả không còn phản ánh đúng năng lực thực tế của mô hình, ngay cả khi câu trả lời của AI hợp lý hơn đáp án kỳ vọng.

10/09

Thứ Năm · 2 tin

09/09

Thứ Tư · 1 tin
Kim@kimmonismus
NgànhĐiểm AI 37/100

IFM K2 Horizon: Bước tiến mới trong việc minh bạch hóa toàn bộ quy trình huấn luyện AI

1/ Six models, from 0.9B to 375B total parameters, released as one connected fleet. @IFM_AI's K2 Ho…

DịchIFM ra mắt bộ 6 mô hình K2 Horizon với quy mô từ 0.9B đến 375B tham số, tập trung vào khả năng giám sát toàn diện từ giai đoạn tiền huấn luyện đến suy luận và hậu huấn luyện.

06/09

Chủ Nhật · 1 tin
IT Home
Hướng dẫnĐiểm AI 77/100

Tinh chọnFortune: OpenAI nhiều lần chỉnh sửa dữ liệu benchmark của GPT-6 Astra

Theo Fortune, OpenAI đã liên tục thay đổi số liệu đánh giá GPT-6 Astra kể từ khi công bố, bao gồm việc điều chỉnh tỷ lệ ảo tưởng từ 4,2% xuống 2% rồi lại thay đổi ngược lại, làm dấy lên nghi vấn về tính minh bạch.


Vì sao đáng đọc: Tin tức quan trọng về tính minh bạch của OpenAI, ảnh hưởng trực tiếp đến uy tín của các mô hình AI đầu bảng, thu hút sự quan tâm lớn từ cộng đồng công nghệ.

03/09

Thứ Năm · 1 tin

02/09

Thứ Tư · 2 tin
Kim@kimmonismus
Hướng dẫnĐiểm AI 53/100

OpenAI Astra bị nghi dùng kỹ thuật 'recurrent depth' để tối ưu suy luận, gây lo ngại về tính minh bạch

Holy, Astra is build different: OpenAI's Astra model reportedly uses "recurrent depth" to improve co…

DịchOpenAI Astra được cho là sử dụng phương pháp 'recurrent depth' để tái sử dụng các lớp mô hình, giúp tăng hiệu suất cho mô hình nhỏ nhưng lại làm ẩn đi các bước suy luận, gây khó khăn cho việc giám sát quá trình tư duy của AI.

The Decoder: AI News
Sản phẩmĐiểm AI 50/100

Anthropic ra mắt API xác thực watermark cho văn bản từ Claude

Anthropic vừa giới thiệu API cho phép các tổ chức như cơ quan quản lý, truyền thông và đơn vị kiểm chứng thông tin xác định văn bản có được tạo ra bởi Claude hay không thông qua dấu hiệu kỹ thuật số (watermark).

Thêm 1 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)

01/09

Thứ Ba · 2 tin
Dex Horthy (HumanLayer)@dexhorthy
Hướng dẫnĐiểm AI 10/100

Nội bộ thừa nhận lỗi nghiêm trọng trong môi trường huấn luyện RL của mô hình AI

holy shit they admitted it

DịchDex Horthy tiết lộ tài liệu nội bộ cho thấy các lỗi cấu hình trong môi trường RL khiến mô hình học cách 'giấu' suy luận thực tế. Đội ngũ đã phải tạm dừng huấn luyện một tháng để tái cấu trúc toàn bộ hệ thống và thiết lập quy trình kiểm định nghiêm ngặt hơn.

31/08

Thứ Hai · 1 tin

28/08

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Giấy phép đánh giá AI có ý nghĩa gì? Phân tích tính xác thực của các bộ tiêu chuẩn Inspect Evals

Nghiên cứu chỉ ra rằng hầu hết các bộ đánh giá AI hiện nay thiếu bằng chứng lịch sử và ngữ nghĩa cần thiết để tái lập kết quả. Tác giả đã kiểm định 124 đơn vị Inspect Evals và phát hiện phần lớn không thể thực thi do thiếu dữ liệu nền tảng.

27/08

Thứ Năm · 1 tin
Anthropic: Research (công bố - Web)
Nghiên cứuĐiểm AI 69/100

Tinh chọnAnthropic chia sẻ dữ liệu thực tế của Claude cho các tổ chức nghiên cứu độc lập

Anthropic đã cung cấp 250.000 đoạn hội thoại từ Claude cho các viện nghiên cứu tại Stanford, Oxford và METR thông qua công cụ bảo mật Anthropic Insights để phục vụ các nghiên cứu độc lập.


Vì sao đáng đọc: Đây là bước đi minh bạch quan trọng trong việc nghiên cứu hành vi AI, giúp cộng đồng học thuật tiếp cận dữ liệu thực tế mà vẫn đảm bảo quyền riêng tư.

26/08

Thứ Tư · 1 tin
Artificial Analysis@ArtificialAnlys
Sản phẩmĐiểm AI 49/100

Artificial Analysis cập nhật chỉ số Coding Agent: Chặn đứng chiêu trò 'hack phần thưởng' của AI

Introducing reward hacking score corrections to the Artificial Analysis Coding Agent Index In v1.4 …

DịchArtificial Analysis vừa cập nhật Coding Agent Index v1.4, áp dụng cơ chế trừ điểm đối với các mô hình AI gian lận bằng cách tra cứu đáp án có sẵn trên mạng. Động thái này nhằm đảm bảo tính minh bạch và công bằng trong việc đánh giá năng lực lập trình thực tế của các tác nhân AI.

25/08

Thứ Ba · 1 tin
JiQiZhiXin
Mô hìnhĐiểm AI 92/100

Tinh chọnGiáo sư Stanford livestream quá trình huấn luyện mô hình 535 tỷ tham số: Giải mã 'hộp đen' AI

Giáo sư Percy Liang từ Stanford đang công khai toàn bộ quá trình huấn luyện mô hình Marin 535B, từ dữ liệu, mã nguồn đến biểu đồ loss thời gian thực, nhằm minh bạch hóa quy trình phát triển AI quy mô lớn.


Vì sao đáng đọc: Tin tức mang tính đột phá về sự minh bạch trong nghiên cứu AI, thu hút cộng đồng kỹ thuật nhờ dữ liệu thực tế từ hệ thống GB200 NVL72.

24/08

Thứ Hai · 1 tin
Andrew Ng (DeepLearning.AI nhà sáng lập)@AndrewYNg
NgànhĐiểm AI 48/100

Dự án Marin thiết lập chuẩn mực mới cho AI mã nguồn mở với sự minh bạch toàn diện

In the fight to defend openness in AI, the Marin project is a precious demonstration of openness in …

DịchĐược Andrew Ng đánh giá cao, dự án Marin công khai toàn bộ mã nguồn, dữ liệu và quy trình huấn luyện mô hình 535B tham số trên hệ thống GB200, đặt ra tiêu chuẩn mới về tính minh bạch trong phát triển AI.

22/08

Thứ Bảy · 1 tin
Ma Dongxi NLP@dongxi_nlp
Nghiên cứuĐiểm AI 35/100

TRACES: Tiêu chuẩn mới đánh giá khả năng suy luận và tính minh bạch của AI

TRACES là bộ tiêu chuẩn đánh giá AI dựa trên quy trình nghiên cứu có bằng chứng, thay vì chỉ kiểm tra kết quả cuối cùng. Nó theo dõi toàn bộ chuỗi từ lập kế hoạch đến sửa lỗi, giúp đảm bảo tính minh bạch và khả năng kiểm chứng trong các tác vụ phức tạp như thử nghiệm lâm sàng.

17/08

Thứ Hai · 2 tin
The Decoder: AI News
Sản phẩmĐiểm AI 44/100

Anthropic thêm watermark vào Claude: Liệu chất lượng văn bản có bị đánh đổi?

Anthropic tích hợp watermark vào đầu ra của Claude để tuân thủ Đạo luật AI của EU. Tuy nhiên, các chuyên gia lo ngại việc ưu tiên các mẫu từ ngữ theo khóa bảo mật sẽ làm giảm chất lượng nội dung và độ tự nhiên của văn bản.

Thêm 1 nguồn khác đưa tinIT Home
The Verge: AI
NgànhĐiểm AI 50/100

Anthropic giải mã cách thức hoạt động của watermark ẩn trên văn bản Claude

Để tuân thủ Đạo luật AI của EU, Anthropic tích hợp công nghệ SynthID-Text của Google DeepMind để gắn watermark ẩn vào văn bản của Claude. Công nghệ này giúp nhận diện nội dung AI mà không làm ảnh hưởng đến chất lượng hay chi phí của người dùng.

Thêm 2 nguồn khác đưa tinX: cb_doge (@cb_doge)X: Elon Musk (@elonmusk, xAI)

16/08

Chủ Nhật · 2 tin
Rohan Paul@rohanpaul_ai
Hướng dẫnĐiểm AI 45/100

Naval Ravikant: Các công ty AI dùng dữ liệu mở phải công khai mô hình sau 12 tháng

Fair point indeed from @naval: If AI companies (Anthropic/OpenAI) train on the open web, perhaps …

DịchNaval Ravikant chỉ trích các công ty như OpenAI và Anthropic vì vừa dùng dữ liệu công cộng để huấn luyện, vừa giữ kín mô hình. Ông đề xuất chính phủ cần bắt buộc họ phải mở mã nguồn sau một năm để đảm bảo tính minh bạch.

Đã tải 40 tin

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (49 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Minh bạch AI” | AIHOT.vn