Nhật báo AI ngày 27/08/2026
vừa công bố GLM-5.3-Flash, mô hình đa phương thức đầu tiên thuộc dòng GLM-5 với 320 tỷ tham số. Sản phẩm đạt hiệu suất ngang ngửa Claude Opus 4.8 nhưng có giá thành cực kỳ cạnh tranh, hiện đã mở API cho các nhà phát triển.
⚡ HÔM NAY CÓ GÌ HOT? (HIGHLIGHTS)
Phát hành / cập nhật mô hình
ra mắt GLM-5.3-Flash: Mô hình đa phương thức 320B với chi phí chỉ bằng 1/40 Claude Opus
vừa công bố GLM-5.3-Flash, mô hình đa phương thức đầu tiên thuộc dòng GLM-5 với 320 tỷ tham số. Sản phẩm đạt hiệu suất ngang ngửa Claude Opus 4.8 nhưng có giá thành cực kỳ cạnh tranh, hiện đã mở API cho các nhà phát triển.
Qwen3.8-Flash-Next: Kiến trúc mới đột phá, tối ưu hóa chi phí vận hành AI
Alibaba ra mắt Qwen3.8-Flash-Next với kiến trúc cải tiến, giúp giảm đáng kể chi phí suy luận mà vẫn duy trì hiệu suất cao, mở đường cho các ứng dụng AI quy mô lớn tiết kiệm hơn.
Google ra mắt Gemini 3.5 Transcribe: Mô hình chuyển đổi giọng nói siêu chính xác cho tương tác thời gian thực
Google DeepMind vừa trình làng Gemini 3.5 Transcribe, mô hình chuyển đổi giọng nói thành văn bản với độ chính xác vượt trội, hỗ trợ hơn 85 ngôn ngữ, nhận diện đa người nói và tùy chỉnh từ vựng linh hoạt.
Tencent Hunyuan nén mô hình dịch thuật Hy-MT2-1.8B xuống còn 440MB, ứng dụng thực tế trên Bilibili
Tencent đã tối ưu hóa mô hình Hy-MT2-1.8B bằng kỹ thuật lượng tử hóa cực thấp, giúp đạt hiệu suất dịch thuật vượt trội trên Bilibili với tốc độ phản hồi chỉ từ 500-800ms.
GlucoFM: Mô hình nền tảng từ Google giúp dự báo chỉ số đường huyết liên tục
Google Research giới thiệu GlucoFM, mô hình AI tự giám sát giúp phân tích xu hướng đường huyết dài hạn và biến động ngắn hạn. Với khả năng dự báo chính xác vượt trội so với các giải pháp hiện có, đây là bước tiến lớn trong việc ứng dụng AI vào theo dõi sức khỏe cá nhân.
Sản phẩm / ứng dụng
Claude chính thức ra mắt tiện ích trình duyệt Chrome cho người dùng trả phí
Anthropic đã phát hành rộng rãi Claude in Chrome, cho phép AI tự động thực hiện các thao tác trên trình duyệt với cơ chế bảo mật nâng cao, giúp ngăn chặn hiệu quả các cuộc tấn công tiêm nhiễm câu lệnh (prompt injection).
Claude Cowork ra mắt trình duyệt tích hợp: Tự động lướt web và thao tác như người dùng
Ứng dụng Claude Cowork vừa bổ sung trình duyệt tích hợp, cho phép AI tự động điều hướng, đọc nội dung và điền biểu mẫu trên web mà không cần cài đặt thêm. Tính năng này ưu tiên bảo mật bằng cách tách biệt hoàn toàn với trình duyệt cá nhân của người dùng.
NVIDIA mở rộng NVLink Fusion, ra mắt công nghệ bộ nhớ tùy chỉnh NVHBM
NVIDIA giới thiệu công nghệ NVHBM giúp tăng 30% băng thông và giảm 15% điện năng tiêu thụ so với HBM4E tiêu chuẩn, đồng thời tối ưu hóa diện tích chip xử lý.
Databricks ra mắt Governance Hub: Giải pháp quản trị thông minh toàn diện cho tài sản dữ liệu
Databricks giới thiệu Governance Hub, cung cấp khả năng quản trị thông minh ở cấp tài khoản, giúp tối ưu hóa chi phí và tăng cường tính minh bạch cho toàn bộ hệ thống dữ liệu của doanh nghiệp.
Google Cloud tối ưu hóa suy luận Embedding đa phương thức trên Cloud TPU với độ chính xác cấp doanh nghiệp
Google Cloud tích hợp hỗ trợ TPU vào vLLM, tối ưu hóa cho dòng mô hình Qwen3 để xử lý suy luận Embedding đa phương thức với ngữ cảnh dài (4K+ token văn bản, 15K+ token đa phương thức).
Claude for Word: Biến bản nháp thành tài liệu hoàn chỉnh trong tích tắc
Tính năng mới tích hợp Claude vào Microsoft Word giúp người dùng tự động hóa việc chỉnh sửa, tinh chỉnh văn phong và hoàn thiện tài liệu chuyên nghiệp ngay trong trình soạn thảo.
Tín hiệu ngành
OpenAI lên tiếng về sự cố Hugging Face và định hướng tương lai
OpenAI chính thức phản hồi về sự cố liên quan đến Hugging Face, nhấn mạnh cam kết cân bằng giữa phát triển AI mở và đảm bảo an toàn hệ thống trong tương lai.
Bê bối: Think tank 'ma' được Israel tài trợ dùng AI thao túng chatbot
Một tổ chức giả danh đã tung ra hàng trăm bài viết được tối ưu hóa bằng AI nhằm thao túng câu trả lời của ChatGPT theo hướng có lợi cho Israel. Đây là chiến dịch truyền thông quy mô lớn được chính phủ Israel tài trợ thông qua các bên trung gian.
Amazon tăng gấp ba đơn hàng chip Nvidia, bổ sung 2 triệu GPU cho hạ tầng AI
Amazon vừa nâng cấp thỏa thuận với Nvidia để bổ sung 2 triệu GPU thế hệ mới cho AWS vào năm 2028, khẳng định nhu cầu hạ tầng AI đang tăng trưởng vượt kỳ vọng.
NVIDIA công bố báo cáo tài chính nửa đầu năm 2027: Lợi nhuận ròng tăng vọt 161,1%
NVIDIA đạt doanh thu 177,8 tỷ USD và lợi nhuận ròng 118 tỷ USD trong nửa đầu năm tài chính 2027. Mảng trung tâm dữ liệu tiếp tục là động lực tăng trưởng chính với doanh thu quý II đạt 89 tỷ USD, đồng thời nền tảng Vera Rubin đã chính thức bước vào giai đoạn sản xuất hàng loạt.
Linear huy động thành công 99 triệu USD, định giá đạt 2,5 tỷ USD
Nền tảng quản lý dự án Linear vừa hoàn tất đợt chào mua 99 triệu USD với định giá 2,5 tỷ USD. Công ty ghi nhận doanh thu định kỳ hàng năm vượt 100 triệu USD, với 50% khối lượng công việc hiện được xử lý bởi các tác nhân AI.
OpenAI mở rộng ChatGPT cho giáo viên tới 55 học khu tại Mỹ, hỗ trợ hơn 100.000 nhà giáo
OpenAI mở rộng chương trình ChatGPT for Teachers đến 55 học khu mới tại Mỹ, cung cấp quyền truy cập miễn phí và đào tạo cho hơn 300.000 giáo viên cùng cam kết bảo mật dữ liệu nghiêm ngặt đến năm 2028.
Nghiên cứu / bài báo
Tiêu chuẩn xác thực ảnh C2PA trên Android bị vô hiệu hóa bởi lỗ hổng root
Nghiên cứu mới chỉ ra rằng kẻ tấn công có quyền root trên Android có thể giả mạo chữ ký C2PA bằng cách lợi dụng StrongBox, khiến tính xác thực của ảnh và video bị đe dọa nghiêm trọng.
Anthropic chia sẻ dữ liệu thực tế của Claude cho các tổ chức nghiên cứu độc lập
Anthropic đã cung cấp 250.000 đoạn hội thoại từ Claude cho các viện nghiên cứu tại Stanford, Oxford và METR thông qua công cụ bảo mật Anthropic Insights để phục vụ các nghiên cứu độc lập.
Báo cáo mới từ OpenAI: ChatGPT phá vỡ giới hạn thời gian trong học tập
OpenAI công bố báo cáo về cách ChatGPT hỗ trợ giáo viên và học sinh mở rộng việc học ngoài lớp học, với hàng trăm triệu lượt truy vấn liên quan đến học thuật mỗi tuần ngay cả trong kỳ nghỉ hè.
IDEA Prune: Apple tối ưu hóa hiệu suất mô hình ngôn ngữ bằng quy trình 'Mở rộng rồi Cắt tỉa'
Apple giới thiệu IDEA Prune, một quy trình kết hợp việc huấn luyện mô hình lớn trước khi cắt tỉa để tối ưu hóa hiệu quả sử dụng token, giúp đạt hiệu suất cao hơn so với việc huấn luyện mô hình kích thước mục tiêu ngay từ đầu.
PROOF-Gen: Tối ưu hóa dữ liệu để nâng cao hiệu quả chưng cất tri thức trong gọi công cụ
PROOF-Gen cải thiện khả năng gọi công cụ của mô hình nhỏ bằng cách tận dụng các tín hiệu thất bại từ mô hình giáo viên, thay vì bỏ qua chúng như các phương pháp truyền thống.
Đánh giá OpenWiki với WikiBench: Liệu tài liệu Wiki có giúp AI lập trình thông minh hơn?
LangChain giới thiệu WikiBench để kiểm chứng hiệu quả của tài liệu Wiki đối với các tác nhân AI lập trình. Kết quả cho thấy việc kết hợp Wiki với mã nguồn giúp cải thiện hiệu suất đáng kể và tối ưu chi phí so với chỉ sử dụng mã nguồn đơn thuần.
Thủ thuật / thực hành
Hướng dẫn huấn luyện và tinh chỉnh mô hình nhúng đa vector với Sentence Transformers
Sentence Transformers v6.0 ra mắt MultiVectorEncoder, hỗ trợ truy xuất hậu tương tác kiểu ColBERT cùng quy trình huấn luyện toàn diện giúp tối ưu hiệu suất RAG.
Trải nghiệm thực tế Doubao Work: 8 mẹo tối ưu hóa hiệu suất làm việc trên Lark
Doubao Work là giải pháp Agent doanh nghiệp dễ tiếp cận nhất hiện nay khi tích hợp sâu vào hệ sinh thái Lark. Bài viết chia sẻ các mẹo sử dụng như điều khiển từ xa, tự động hóa tác vụ và khả năng đồng bộ trực tiếp, giúp tối ưu hóa quy trình làm việc chuyên nghiệp.
Warp: Cách xây dựng AI tự tối ưu hóa trên nền tảng Claude
Warp áp dụng mô hình Agent Skills để biến phản hồi từ con người thành vòng lặp tự cải tiến cho AI, giúp tối ưu hóa quy trình code trên quy mô lớn. Phương pháp này nhấn mạnh việc thiết lập nguyên tắc thay vì quy tắc cứng nhắc để tăng tính linh hoạt.
Hướng dẫn sử dụng GitHub Copilot: Tự động hóa phân loại Dependabot Pull Request
GitHub Copilot giờ đây có thể tự động xử lý bước đầu các yêu cầu Dependabot, từ phân loại rủi ro, kiểm tra CI đến tổng hợp báo cáo, giúp lập trình viên tiết kiệm thời gian quản lý bảo mật.
Bill Gates kêu gọi xây dựng chiến lược AI toàn diện, Gary Marcus đồng tình
Bill Gates cảnh báo về các rủi ro từ AI như khủng bố sinh học và tin giả, đồng thời kêu gọi sự tham gia của xã hội dân sự trong việc thiết lập khung quản trị AI toàn cầu. Gary Marcus đánh giá cao quan điểm này, cho rằng nó tương đồng với những luận điểm trong cuốn sách mới nhất của ông.