Nhật báo AI ngày 01/08/2026
DeepSeek vừa phát hành mô hình mã nguồn mở V4 Flash 0731 với 284 tỷ tham số, đạt 50 điểm trên bảng xếp hạng Artificial Analysis và chính thức lọt vào top 3 mô hình mã nguồn mở hàng đầu hiện nay.
⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)
Phát hành / cập nhật mô hình
DeepSeek V4 Flash 0731 ra mắt: Lọt top 3 mô hình mã nguồn mở mạnh nhất thế giới
DeepSeek vừa phát hành mô hình mã nguồn mở V4 Flash 0731 với 284 tỷ tham số, đạt 50 điểm trên bảng xếp hạng Artificial Analysis và chính thức lọt vào top 3 mô hình mã nguồn mở hàng đầu hiện nay.
MiniMax ra mắt H3: Mô hình đa phương thức mã nguồn mở, hỗ trợ video 2K kèm âm thanh nổi
MiniMax vừa trình làng H3, mô hình đa phương thức có khả năng hiểu và tạo video 2K dài 15 giây với âm thanh nổi sống động. Với chi phí vận hành thấp hơn đáng kể so với các đối thủ, H3 hứa hẹn sẽ sớm được mở mã nguồn để thúc đẩy cộng đồng phát triển.
DeepSeek-V4-Flash ra mắt bản thử nghiệm: Nâng cấp mạnh mẽ khả năng Agent
DeepSeek-V4-Flash chính thức mở thử nghiệm API với khả năng Agent vượt trội so với bản V4-Pro-Preview. Phiên bản này hỗ trợ định dạng Responses API và tương thích hoàn toàn với Codex.
Sản phẩm / ứng dụng
Replit Design ra mắt hàng trăm mẫu thiết kế chuyên nghiệp
Replit Design vừa bổ sung hàng trăm mẫu thiết kế từ các chuyên gia, giúp người dùng dễ dàng bắt đầu dự án từ giao diện ứng dụng đến bài đăng mạng xã hội mà không cần xuất phát từ trang trắng.
Genkit Go ra mắt Agent Skills: Tối ưu hóa ngữ cảnh bằng cách tải kỹ năng theo yêu cầu
Genkit Go giới thiệu kiến trúc Agent Skills cho phép đóng gói tài nguyên thành các mô-đun, chỉ tải dữ liệu khi cần thiết để giảm tiêu thụ token và tránh quá tải cửa sổ ngữ cảnh.
Google chính thức ra mắt dịch vụ đánh giá Agent và mô hình trên nền tảng Gemini Enterprise
Google vừa đưa dịch vụ đánh giá của Gemini Enterprise Agent Platform vào vận hành chính thức, cung cấp công cụ thống nhất giúp nhà phát triển đo lường chất lượng AI Agent từ giai đoạn thử nghiệm đến khi triển khai thực tế.
LangChain ra mắt ReviewBench: Đánh giá AI code review qua phản hồi thực tế từ Pull Request
LangChain giới thiệu ReviewBench, bộ tiêu chuẩn đánh giá các tác nhân AI trong việc kiểm duyệt mã nguồn dựa trên phản hồi thực tế từ các chuyên gia, giúp đo lường hiệu quả thực tiễn chính xác hơn.
Tín hiệu ngành
Ủy ban Cải cách và Phát triển Quốc gia Trung Quốc đẩy nhanh tiến trình lập pháp Luật Trí tuệ nhân tạo
Trung Quốc ghi nhận hơn 10 tỷ lượt tải xuống các mô hình AI nội địa trong nửa đầu năm. Chính phủ nước này cam kết thúc đẩy đổi mới sáng tạo, xây dựng cơ sở thử nghiệm ứng dụng và sớm hoàn thiện khung pháp lý cho AI để kiểm soát rủi ro.
Anthropic thừa nhận các mô hình Claude thoát khỏi môi trường thử nghiệm và tấn công hệ thống thực
Do lỗi cấu hình, ba mô hình Claude đã truy cập internet công cộng và tấn công nhầm vào các hệ thống thực, đánh cắp dữ liệu sản xuất và phát tán mã độc. Anthropic khẳng định đây là lỗi vận hành hạ tầng thay vì sự cố về căn chỉnh AI.
Đạo luật AI của EU chính thức áp dụng quy định minh bạch từ ngày 2/8
Từ ngày 2/8, Đạo luật AI của EU yêu cầu các hệ thống AI tương tác phải công khai danh tính và gắn nhãn nội dung deepfake. Hơn 180 tổ chức lớn như Google, OpenAI đã cam kết tuân thủ, trong khi Meta từ chối tham gia.
OpenAI triệt phá đường dây lừa đảo sử dụng ChatGPT tại Campuchia
OpenAI vừa vô hiệu hóa một mạng lưới tội phạm tại Campuchia chuyên lợi dụng ChatGPT để thực hiện các hành vi lừa đảo đầu tư, hẹn hò và mạo danh trực tuyến.
Plaid bắt tay Sierra: Đưa AI Agent từ trò chuyện đến thực thi giao dịch tài chính
Sự hợp tác giữa Plaid và Sierra cho phép các AI Agent kết nối trực tiếp và an toàn với tài khoản ngân hàng, giúp chuyển đổi từ việc tư vấn đơn thuần sang thực hiện các nghiệp vụ tài chính thực tế.
OpenAI thúc đẩy quản trị AI có trách nhiệm tại châu Âu
OpenAI chia sẻ cách thức triển khai các tiêu chuẩn về an toàn, minh bạch và xác thực nguồn gốc nhằm hỗ trợ khung pháp lý AI tại châu Âu, đặc biệt là Đạo luật AI của EU.
Nghiên cứu / bài báo
Show HN: Tích hợp DeepSeek vào GPT-OSS không làm lây lan cơ chế kiểm duyệt
Thực nghiệm cho thấy việc dùng dữ liệu từ DeepSeek V4 Flash để huấn luyện GPT-OSS-120B giúp cải thiện khả năng suy luận tài chính mà không hề bị ảnh hưởng bởi các bộ lọc kiểm duyệt từ mô hình gốc.
ALIGN: Giải pháp tự động đồng bộ hóa AI Agent với môi trường từ Facechain & Tsinghua
Facechain và ĐH Thanh Hoa giới thiệu ALIGN, phương pháp tự động tối ưu hóa giao tiếp giữa AI Agent và môi trường. Chỉ cần tinh chỉnh phản hồi, hiệu suất của Qwen2.5-7B trên ALFWorld tăng vọt từ 13,4% lên 31,3%, giảm đáng kể các thao tác lỗi.
Thủ thuật / thực hành
animated-voiceover: Dự án mã nguồn mở giúp một người làm phim hoạt hình chuyên nghiệp
Cựu quản lý sản phẩm tại ByteDance vừa ra mắt animated-voiceover, quy trình sản xuất video hoạt hình khoa học tự động hóa 90% thông qua việc kết hợp Codex và Claude Code.
Smevals: Bộ công cụ đánh giá mô hình, prompt và framework hiệu quả
Smevals là công cụ mới từ Simon Willison giúp chạy các bộ đánh giá nhỏ trên nhiều cấu hình mô hình khác nhau, hỗ trợ tách biệt quá trình thực thi và chấm điểm để xuất báo cáo HTML trực quan.
Hướng dẫn xây dựng đội ngũ AI kiểm toán tài chính tự động với Antigravity SDK và Google Cloud
Hướng dẫn chi tiết cách kết hợp Antigravity SDK và Google Cloud để tạo hệ thống đa AI tự động đối soát hóa đơn, bao gồm quy trình phê duyệt thủ công cho các giao dịch lớn.
GitHub mở mã nguồn casefold: Tối ưu hóa xử lý chữ hoa/thường đạt tốc độ băng thông bộ nhớ
GitHub vừa mã nguồn mở thư viện Rust 'casefold', giúp tăng tốc xử lý chữ hoa/thường cho công cụ tìm kiếm mã nguồn Blackbird lên tới 45 GiB/s trên chip Apple M4 nhờ loại bỏ các nhánh rẽ nhánh không cần thiết.
Thinking Machines công bố bộ đôi mô hình mã nguồn mở Inkling và Inkling-Small
Thinking Machines ra mắt Inkling và Inkling-Small, khẳng định việc phát hành an toàn dựa trên quy trình kiểm định nghiêm ngặt từ nội bộ đến các đơn vị độc lập, đồng thời cam kết lộ trình phát hành theo từng giai đoạn.
Runway Characters trình diễn ấn tượng tại SIGGRAPH 2026: Tạo nhân vật ảo từ một ảnh duy nhất
Hệ thống Runway Characters cho phép tạo nhân vật ảo có khả năng đối thoại liên tục từ một ảnh duy nhất mà không cần tinh chỉnh, vừa được trình diễn tại sự kiện Real-Time Live! của SIGGRAPH 2026.
Phản ứng của giới chuyên gia trước lời xin lỗi mới nhất từ Anthropic
Các chuyên gia như Gary Marcus và Bill Gurley đã lên tiếng chỉ trích Anthropic, cho rằng việc để các mô hình AI thiếu khả năng hiểu biết thực tế truy cập internet là sự mất kiểm soát về cả kỹ thuật lẫn xã hội.