Ngành
NVIDIA thâu tóm HuggingFace với giá 13 tỷ USD, OpenAI công bố báo cáo sự cố nền tảng
(giờ Việt Nam)
Tóm tắt AI
Thương vụ tỷ đô giữa NVIDIA và HuggingFace đánh dấu bước ngoặt lớn cho cộng đồng mã nguồn mở, trong khi OpenAI chia sẻ bài học từ sự cố kỹ thuật gần đây.
Chính văn · Bản dịch AI
![[AINews] NVIDIA buys HuggingFace for $13B, as OpenAI publishes their HF incident retro](https://substackcdn.com/image/fetch/$s_!FSM7!,w_1200,h_675,c_fill,f_jpg,q_auto:good,fl_progressive:steep,g_auto/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa61da113-3d9b-4206-81c1-06da7b4a9a0c_1362x1278.png)
TheInformation đã có tin độc quyền, và giờ đây họ đã xác nhận — Nvidia đang mua lại HuggingFace với giá 13 tỷ USD, tương đương khoảng 80 lần mức ARR 150 triệu USD của họ, sau khi đã tăng gấp đôi cơ sở khách hàng trong năm 2026. Con số này gần gấp đôi mức đề nghị ban đầu 7 tỷ USD của Nvidia vào tháng 1 năm 2026.

Chúng ta có thể nói gì đây? Chúng tôi rất vui khi thấy những người tốt giành chiến thắng. Nhưng trong bối cảnh GLM-5.3-Flash (hay còn gọi là Ox Alpha) đang gây ấn tượng với tất cả mọi người (ngoại trừ những người hay đăng tin mơ hồ tại GDM) và Qwen cũng vừa ra mắt một mô hình Flash ấn tượng trên chip Trung Quốc, có lẽ cuộc thảo luận sau sự kiện Hot Chips về AI mở phương Tây là một bối cảnh tuyệt vời cho điều này.
Tin tức AI từ ngày 25/8/2026 đến 26/8/2026. Chúng tôi đã kiểm tra 12 subreddit, 544 tài khoản Twitter và không có thêm thông tin nào từ Discord. Trang web của AINews cho phép bạn tìm kiếm tất cả các số đã phát hành. Xin nhắc lại, AINews hiện là một chuyên mục của Latent Space. Bạn có thể chọn nhận hoặc hủy nhận email theo tần suất tùy ý!
Tin chính: Ra mắt GLM 5.3 Flash và các phản ứng
Z.ai đã chính thức ra mắt GLM-5.3-Flash, tiết lộ rằng mô hình "Ox Alpha" được giới thiệu trước đó chính là danh tính công khai của nó.
Z.ai công bố GLM-5.3-Flash là một mô hình đa phương thức (multimodal) nguyên bản với cửa sổ ngữ cảnh 1 triệu token, tổng cộng 320 tỷ tham số / 18 tỷ tham số hoạt động, được phát hành theo Giấy phép MIT và khả dụng thông qua trọng số (weights), API, chat, gói lập trình và AutoClaw.
Đồng thời, Z.ai định vị đây là phiên bản kế nhiệm có tính cạnh tranh cao về giá so với GLM-5.2, khẳng định trên bộ tiêu chuẩn đánh giá nội bộ rằng nó vượt trội hơn GLM-5.2 ở mọi cấp độ nỗ lực và ngang bằng với Claude Opus 4.8 về khả năng lập trình.
Sự kiện ra mắt cũng giải đáp bí ẩn kéo dài về Ox Alpha: nhiều người đăng bài đã kết nối rõ ràng Ox Alpha với GLM-5.3-Flash, bao gồm SemiAnalysis, rasbt, theo và Cline.
Sự hỗ trợ cơ sở hạ tầng mô hình từ bên thứ ba xuất hiện gần như ngay lập tức: CoreWeave, Baseten và tích hợp miễn phí của Cline trong VS Code / JetBrains / CLI.
Ngay sau khi ra mắt, kỹ sư Zixuan Li của Z.ai cho biết mẫu chat (chat template) đã được cập nhật và những người tải xuống sớm nên tải lại mô hình, ngụ ý về việc sửa lỗi đóng gói hoặc định dạng gợi ý (prompt-format) ngay ngày đầu tiên.
Artificial Analysis ban đầu đã công bố tổng quan với thông tin không chính xác về cửa sổ ngữ cảnh 400k, sau đó đã đính chính thành 1 triệu ngữ cảnh, khớp với thông báo gốc của Z.ai.
Phản ứng của cộng đồng mạnh mẽ một cách bất thường đối với một bản phát hành mở trọng số, từ những phản ứng sốc ngắn gọn như “HOLY” đến những khẳng định thực chất hơn rằng mô hình này hiện có thể là lựa chọn thông minh nhất trên mỗi đô la, ví dụ như từ Artificial Analysis và zainhas.
Sự kiện ra mắt này được đưa vào một câu chuyện rộng lớn hơn xoay quanh các mô hình mở tiên phong của Trung Quốc, với các bài đăng lập luận rằng các phòng thí nghiệm mở của Trung Quốc đang hội tụ về các lựa chọn kiến trúc tương tự xung quanh linear attention, sparse attention, thiết kế đường dẫn dư (residual path design) và Muon.
Sự phản đối độc lập đã xuất hiện đối với ít nhất một tuyên bố về phương thức: skalskip92 lập luận rằng mô hình có vẻ yếu trong một số tác vụ thị giác/phát hiện đối tượng mặc dù được quảng bá là “native vision” (thị giác nguyên bản).
Tweet ra mắt chính của Z.ai là mỏ neo thực tế: GLM-5.3-Flash được mô tả là:
320 tỷ tổng tham số / 18 tỷ tham số hoạt động
Cửa sổ ngữ cảnh 1 triệu token
Đa phương thức nguyên bản
Giấy phép MIT
Trước đó được giới thiệu là Ox Alpha
“chạy hoàn toàn trên chip AI của Trung Quốc”
Phân phối/khả dụng khi ra mắt:
Trọng số trên Hugging Face
Z.ai API
Chat
ZCode
Gói lập trình
AutoClaw
Tuyên bố về hiệu suất mạnh mẽ nhất từ phía nhà cung cấp đến từ luồng thảo luận về lập trình của Z.ai: trên Z.ai Code Bench, GLM-5.3-Flash “vượt trội rõ rệt so với GLM-5.2 ở mọi cấp độ nỗ lực và hoạt động ngang bằng với Claude Opus 4.8”. Vì đây là đánh giá từ bên thứ nhất, nó hữu ích nhưng nên được đọc với sự thận trọng hơn so với các đánh giá độc lập.
Một bài đăng hỗ trợ ra mắt tiếp theo từ AutoClaw đã định hình mô hình này phù hợp cho việc hiểu ngôn ngữ thị giác, tạo mã và các tác vụ đại lý (agentic) dài hạn, đồng thời kết hợp khả dụng với các khoản tín dụng/hoàn tiền, nhưng đây chủ yếu là thông tin triển khai thay vì bằng chứng kỹ thuật mới: Bài đăng ra mắt AutoClaw.
Đánh giá độc lập thực chất nhất trong tập hợp các tweet đến từ Artificial Analysis. Tóm tắt của họ: GLM-5.3-Flash đạt 57 điểm trên Chỉ số Thông minh của Artificial Analysis.
Điểm Chỉ số Thông minh AA: 57
Khoảng cách so với GLM-5.3: kém 3 điểm so với mức 60 của GLM-5.3
Chi phí mỗi tác vụ: 0,09 USD
Giá API: 0,15 USD / 1 triệu đầu vào, 0,50 USD / 1 triệu đầu ra
Đầu vào được lưu trữ (Cached input): ~0,026–0,03 USD / 1 triệu, được mô tả là giảm giá 80%
Kích thước mô hình: 320 tỷ tổng / 18 tỷ hoạt động
Giấy phép: MIT
Bài viết được AI dịch và tổng hợp tự động từ Latent Space. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.