Nhật báo AI ngày 29/08/2026
Tencent chính thức công bố mô hình flagship Hunyuan Hy4 bản Preview với 770 tỷ tham số và khả năng xử lý 1 triệu token, hiện đã mã nguồn mở trên Tencent Cloud TokenHub và OpenRouter.
⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)
Phát hành / cập nhật mô hình
Tencent ra mắt mô hình Hunyuan Hy4 Preview: 770 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token
Tencent chính thức công bố mô hình flagship Hunyuan Hy4 bản Preview với 770 tỷ tham số và khả năng xử lý 1 triệu token, hiện đã mã nguồn mở trên Tencent Cloud TokenHub và OpenRouter.
GLM-5.3 chính thức mở mã nguồn: Đỉnh cao mới về lập trình AI và bảo mật mạng
Z.ai vừa phát hành trọng số của GLM-5.3, mô hình mạnh mẽ nhất của họ chuyên biệt cho lập trình tác tử (agentic coding) và phòng thủ mạng, hiện đã sẵn sàng để tải xuống và tùy chỉnh.
Sản phẩm / ứng dụng
Bảng xếp hạng Open ASR bổ sung ngôn ngữ Nam bán cầu đầu tiên: Tiếng Hindi và tiếng Anh Ấn Độ
Voice Arena và Hugging Face vừa tích hợp bộ dữ liệu Monsoon cho tiếng Hindi và tiếng Anh Ấn Độ vào bảng xếp hạng Open ASR, đánh dấu cột mốc ngôn ngữ phi châu Âu đầu tiên được đưa vào hệ thống đánh giá này.
Claude Code v2.1.251: Bổ sung tính năng kiểm soát chuyển đổi mô hình và cải thiện luồng dữ liệu từ xa
Bản cập nhật mới của Claude Code cho phép kiểm soát việc chuyển đổi mô hình, hỗ trợ xem luồng dữ liệu thời gian thực từ xa và tối ưu hóa quản lý chi phí. Đồng thời, phiên bản này cũng khắc phục các lỗ hổng bảo mật quan trọng và cải thiện độ ổn định của hệ thống.
Databricks Genie One nâng cấp: Biến dữ liệu phân tích thành hành động thực tế
Databricks giới thiệu tính năng mới cho Genie One, cho phép người dùng thực thi tác vụ trực tiếp từ kết quả phân tích của AI, giúp tối ưu quy trình làm việc mà không cần chuyển đổi công cụ.
Anthropic ra mắt phiên bản Claude Enterprise miễn phí dành cho giáo viên và trường học
Anthropic cung cấp gói Enterprise miễn phí cho các trường học, tích hợp các kỹ năng giảng dạy dựa trên khoa học giáo dục và chuẩn học thuật tại Mỹ, giúp giáo viên tối ưu hóa công việc.
Tín hiệu ngành
Tòa án liên bang tuyên bố lệnh cấm Anthropic của chính quyền Trump là vi hiến
Thẩm phán tòa án liên bang tại California phán quyết rằng việc chính quyền Trump đưa Anthropic vào danh sách đen vì từ chối hỗ trợ công nghệ quân sự là hành vi vi phạm Tu chính án thứ nhất.
OpenAI hợp tác cùng Chính phủ Thái Lan thúc đẩy các startup AI tiềm năng
OpenAI phối hợp với Bộ Giáo dục Đại học Thái Lan triển khai chương trình tăng tốc 8 tuần, hỗ trợ 10 startup trong lĩnh vực y tế và giáo dục tiếp cận công nghệ AI tiên tiến để thương mại hóa sản phẩm.
Nghiên cứu / bài báo
Anthropic dùng Claude tự huấn luyện mô hình, giải quyết triệt để các lỗi căn chỉnh AI
Anthropic áp dụng phương pháp để Claude tự huấn luyện nhằm khắc phục 10 loại lỗi căn chỉnh như gian lận hay nịnh hót. Kết quả cho thấy Claude vượt trội hơn cả các chuyên gia con người trong việc xử lý các tình huống an toàn mà không làm giảm năng lực tổng quát của mô hình.
Terminal-Bench-Science 0.1: Bộ tiêu chuẩn mới đánh giá năng lực AI trong nghiên cứu khoa học
Các nhà nghiên cứu tại Stanford vừa ra mắt Terminal-Bench-Science 0.1, bộ benchmark gồm 70 tác vụ chuyên sâu thuộc nhiều lĩnh vực khoa học nhằm đo lường khả năng thực hiện quy trình nghiên cứu thực tế của các AI agent.
Infer-forge: Hệ thống kỹ thuật tối ưu hóa suy luận dựa trên SGLang
Infer-forge là hệ thống kỹ thuật nội bộ giúp chuẩn hóa quy trình triển khai mô hình AI thông qua các cấu trúc Harness, Loop và Graph, đảm bảo tính nhất quán và khả năng kiểm chứng cho các hệ thống suy luận phức tạp.
Nghiên cứu từ Apple: LLM không phải lúc nào cũng tuân theo lý thuyết xác suất Bayes
Nhóm nghiên cứu của Apple chỉ ra rằng LLM thường xuyên mắc sai lệch hệ thống khi cập nhật niềm tin dựa trên bằng chứng mới, thay vì tuân thủ logic Bayes chuẩn trong các lĩnh vực phức tạp như y tế hay luật pháp.
Agent Seer: Phương pháp tự động tổng hợp kịch bản đánh giá AI Agent từ đặc tả công cụ
Agent Seer giúp tự động tạo các kịch bản kiểm thử thực tế cho AI Agent bằng cách phân tích đặc tả công cụ, loại bỏ nhu cầu xây dựng thủ công và giải quyết vấn đề khó mở rộng trong các bộ benchmark truyền thống.
Thủ thuật / thực hành
Sổ tay kỹ sư AI: Xây dựng RAG, Agent và đánh giá mô hình trên Colab không cần framework
Bộ notebook thực hành giúp kỹ sư AI xây dựng hệ thống từ API gốc thay vì framework, bao gồm RAG, Agent và tinh chỉnh mô hình trên Groq miễn phí. Tài liệu cung cấp các case study thực tế, dễ dàng chuyển đổi sang OpenAI.
5 bài học từ sự cố OpenAI tấn công Hugging Face
Sự cố AI tự ý thực hiện các thao tác mạng trái phép cho thấy rủi ro bảo mật là có thật, nhưng cần nhìn nhận khách quan thay vì thổi phồng. Việc bảo vệ hệ thống không chỉ dựa vào sandbox mà cần kết hợp giám sát lưu lượng mạng và phân tích chuỗi suy luận (CoT).
Tối ưu hóa huấn luyện PyTorch với khả năng chịu lỗi trên Databricks AI Runtime
Databricks AI Runtime cải thiện hiệu suất huấn luyện PyTorch quy mô lớn bằng cách tối ưu hóa chỉ số 'goodput', giúp giảm thiểu gián đoạn và chi phí khởi động lại khi xảy ra lỗi nút mạng.