Nhật báo AI ngày 20/08/2026
Liquid AI giới thiệu các checkpoint Q4_0 cho dòng mô hình LFM 2.5, sử dụng kỹ thuật chưng cất nhận thức lượng tử (QAD) để duy trì tốc độ cao trong khi khôi phục tới 97% độ chính xác so với chuẩn BF16.
⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)
Phát hành / cập nhật mô hình
Liquid AI ra mắt dòng LFM 2.5 với kỹ thuật QAD: Khôi phục 97% độ chính xác sau khi lượng tử hóa
Liquid AI giới thiệu các checkpoint Q4_0 cho dòng mô hình LFM 2.5, sử dụng kỹ thuật chưng cất nhận thức lượng tử (QAD) để duy trì tốc độ cao trong khi khôi phục tới 97% độ chính xác so với chuẩn BF16.
Sản phẩm / ứng dụng
Ra mắt GLM-5.3: Đạt 60 điểm chỉ số thông minh AA, dẫn đầu nhóm mô hình mã nguồn mở
GLM-5.3 chính thức ra mắt với khả năng lập trình và bảo mật vượt trội, đạt 60 điểm trên thang đo AA, ngang hàng với các mô hình đầu bảng hiện nay nhưng với chi phí vận hành tối ưu hơn.
FastMetal: Tạo video ngay trên Mac chỉ trong 30 giây mà không cần GPU rời
FastMetal mang mô hình FastWan-QAD lên chip Apple Silicon, cho phép tạo video 480P chỉ trong 30 giây với 3.9GB RAM mà không cần CUDA hay điện toán đám mây.
Google Search ra mắt 5 công cụ học tập tích hợp AI mới
Google vừa giới thiệu 5 công cụ học tập AI trên Search, bao gồm giao diện tương tác AI Mode và tính năng luyện thi cho các kỳ thi chuẩn hóa như SAT, ACT (hiện hỗ trợ tiếng Anh).
Replit ra mắt chế độ miễn phí tích hợp GPT-5.6 Luna, hỗ trợ lập trình không giới hạn
Replit giới thiệu chế độ miễn phí sử dụng mô hình GPT-5.6 Luna, cho phép người dùng hiện thực hóa ý tưởng thành phần mềm mà không lo về chi phí token, đồng thời hỗ trợ chuyển đổi linh hoạt sang GPT-5.6 Sol khi cần suy luận chuyên sâu.
Claude Code v2.1.236: Bổ sung biến môi trường mặc định và thông báo khi để máy nhàn rỗi
Bản cập nhật mới cho phép thiết lập mô hình mặc định qua biến môi trường ANTHROPIC_DEFAULT_MODEL, đồng thời hỗ trợ ghi nhớ lựa chọn mô hình ngay cả khi khởi động lại phiên làm việc.
Tín hiệu ngành
Anthropic tạm dừng huấn luyện RL, siết chặt an ninh trước lo ngại về năng lực tấn công mạng của AI
Trước lo ngại mô hình Astra có thể đạt ngưỡng năng lực tấn công mạng nguy hiểm, Anthropic quyết định tạm dừng huấn luyện tăng cường (RL) và áp dụng các tiêu chuẩn an ninh nghiêm ngặt nhất cho hạ tầng nghiên cứu.
OpenRouter chính thức về chung một nhà với Stripe
OpenRouter sáp nhập vào Stripe để thúc đẩy hạ tầng thanh toán cho AI, cam kết duy trì hoạt động độc lập và ưu tiên lợi ích người dùng trong việc điều phối mô hình.
Nghiên cứu / bài báo
Tối ưu hóa DeepSeek-V4-Pro trên GPU H20: Đột phá hiệu năng tiệm cận chip B300
Nhóm LMSYS đã tối ưu hóa mô hình MoE 1.6 nghìn tỷ tham số DeepSeek-V4-Pro trên GPU H20, đạt tốc độ 271 tokens/s, thu hẹp đáng kể khoảng cách hiệu năng so với chip B300.
Nghiên cứu từ Apple: Phân tích đa chiều về hành vi giống người của các mô hình ngôn ngữ lớn (LLM)
Đội ngũ nghiên cứu của Apple đã phân tích cách LLM thể hiện cảm xúc và thiết lập ranh giới với người dùng. Nghiên cứu cung cấp cái nhìn sâu sắc giúp các nhà phát triển kiểm soát hành vi giống người của AI một cách hiệu quả.
Tính P-đầy đủ trong duyệt chỉ mục ngược: Đánh giá độ phức tạp của truy vấn Boolean trên đồ thị DAG
Nghiên cứu chỉ ra rằng các chiến lược truy vấn chỉ mục ngược truyền thống gặp giới hạn lý thuyết nghiêm trọng, dẫn đến sự bùng nổ độ phức tạp theo hàm mũ khi xử lý các truy vấn Boolean phức tạp trong suy luận thần kinh-biểu tượng.
Thủ thuật / thực hành
Hướng dẫn sử dụng GitHub Copilot: Quản lý công việc hiệu quả với bảng My Work
Khám phá tính năng My Work trên ứng dụng GitHub Copilot giúp tập trung quản lý Pull Request và Issue. Bạn có thể tùy chỉnh bộ lọc, tạo hội thoại thông minh trực tiếp từ tác vụ và linh hoạt chuyển đổi giữa các chế độ xem để tối ưu hóa quy trình làm việc.
Slack và chiến lược xây dựng đội ngũ cộng tác giữa người và AI
Slack chia sẻ cách tận dụng các cuộc hội thoại làm nền tảng tri thức, kết hợp AI của Claude để tự động hóa công việc, giúp con người tập trung vào khâu ra quyết định và kiểm soát chất lượng.
Bí quyết thiết kế Genie Agents hiệu quả từ Databricks: Tối ưu hóa chỉ với một câu lệnh
Databricks chia sẻ hướng dẫn giúp các nhà phát triển tinh chỉnh Genie Agents, khắc phục lỗi chọn sai dữ liệu và nâng cao độ chính xác khi truy vấn thông tin phức tạp.