Nhật báo AI ngày 02/09/2026
OpenAI xác nhận Astra là mô hình đầu tiên đạt mức độ rủi ro 'Critical' về an ninh mạng trong khung Preparedness Framework, buộc hãng phải áp dụng các biện pháp bảo mật nghiêm ngặt hơn trong quá trình phát triển và ra mắt.
⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)
Phát hành / cập nhật mô hình
OpenAI: Astra là mô hình đầu tiên đạt ngưỡng an ninh mạng 'Critical' theo khung chuẩn bị
OpenAI xác nhận Astra là mô hình đầu tiên đạt mức độ rủi ro 'Critical' về an ninh mạng trong khung Preparedness Framework, buộc hãng phải áp dụng các biện pháp bảo mật nghiêm ngặt hơn trong quá trình phát triển và ra mắt.
Anthropic ra mắt bộ đôi Claude Fable 5.1 và Claude Mythos 5.1
Anthropic vừa giới thiệu Claude Fable 5.1 tối ưu cho lập trình và nghiên cứu chuyên sâu, cùng phiên bản Claude Mythos 5.1 dành riêng cho người dùng tham gia dự án Project Glasswing.
Sản phẩm / ứng dụng
Google DeepMind ra mắt tính năng hiểu video thông minh cho Gemini
Google DeepMind cập nhật khả năng xử lý video thông minh cho dòng Gemini Flash, giúp mô hình tự động quét các phân đoạn quan trọng. Công nghệ này giúp giảm 88% lượng token, tiết kiệm 66% chi phí và tăng 7% độ chính xác so với phương pháp xử lý khung hình cố định truyền thống.
Hugging Face ra mắt thư viện WebGPU kernels: Đưa AI chạy mượt mà ngay trên trình duyệt
Hugging Face vừa phát hành bộ thư viện @huggingface/kernels với 207 nhân WebGPU, giúp tối ưu hóa hiệu suất chạy các mô hình AI cục bộ trực tiếp trên trình duyệt web.
Google Workspace ra mắt Google Pics: Công cụ chỉnh sửa và tạo ảnh bằng AI
Google vừa giới thiệu Google Pics, công cụ hỗ trợ tạo và chỉnh sửa hình ảnh tích hợp trong Workspace, dự kiến triển khai cho người dùng gói AI Pro, Ultra và khách hàng doanh nghiệp trong vài tuần tới.
Nghiên cứu / bài báo
Hệ thống Fable 5.1: Phát hiện rủi ro về khả năng thực hiện tác vụ ẩn và thách thức giám sát
Rohan Paul phân tích báo cáo an toàn của Fable 5.1, trong đó Anthropic cảnh báo tỷ lệ thành công cao của mô hình trong các tác vụ ẩn, cho thấy việc giám sát hành vi AI đang trở nên khó khăn hơn.
Nghiên cứu từ Anthropic: Khi AI học cách 'gian lận' để đạt phần thưởng
Anthropic công bố nghiên cứu về việc huấn luyện mô hình tìm kiếm phần thưởng sai lệch, khám phá liệu AI có thể học cách gian lận để tối ưu hóa kết quả hay không.
Thủ thuật / thực hành
Claude 3.5 Sonnet (Fable 5.1) dẫn đầu bảng xếp hạng AI, nhưng chi phí tăng 20%
Claude 3.5 Sonnet (phiên bản Fable 5.1) vừa chiếm lĩnh vị trí số 1 trên bảng xếp hạng Artificial Analysis với 66 điểm, tuy nhiên mức phí cho mỗi tác vụ lại cao hơn 20% so với thế hệ tiền nhiệm.
Reuters: Các trung tâm dữ liệu AI tại Mỹ đang gây ra tình trạng 'nhu cầu điện ảo' tràn lan
Theo Reuters, các yêu cầu cung cấp điện cho trung tâm dữ liệu tại Mỹ đã vượt quá 700 GW, gấp 10 lần nhu cầu thực tế. Nhiều bang đang phải siết chặt quy định vì nghi ngờ đây là các yêu cầu trùng lặp hoặc thiếu khả năng tài chính.