Tin ngành
Mô hình AI 'bí ẩn' Ox Alpha vận hành hoàn toàn bằng chip nội địa Trung Quốc
(giờ Việt Nam)
Tóm tắt AI
Công ty Z.AI khẳng định mô hình Ox Alpha (GLM-5.3-Flash) của họ chạy độc lập trên hệ thống chip do Trung Quốc tự sản xuất, đánh dấu bước tiến mới trong nỗ lực tự chủ công nghệ.
Bản dịch AI

'AI bí ẩn' Ox Alpha vận hành hoàn toàn bằng chip Trung Quốc
Công ty Z.AI cho biết mô hình GLM-5.3-Flash, hay còn gọi là Ox Alpha, của họ được vận hành hoàn toàn bằng các dòng chip do Trung Quốc tự sản xuất.
Ngày 27/8, startup Z.AI (tên gọi tại Trung Quốc là Zhipu AI) đã chính thức ra mắt phiên bản mô hình nguồn mở GLM-5.3-Flash, xác nhận đây chính là Ox Alpha. Trước đó, Ox Alpha được thử nghiệm dưới dạng "mô hình bí mật" từ một bên thứ ba ẩn danh trên các nền tảng OpenRouter và OpenCode nhằm thu thập phản hồi của người dùng trước khi phát hành chính thức và đã nhanh chóng gây sốt trên toàn cầu.
Tại lễ công bố, Z.AI nhấn mạnh GLM-5.3-Flash "hoạt động hoàn toàn" trên một cụm máy chủ chứa 100.000 chip AI nội địa. Công ty không nêu cụ thể nhà cung cấp, nhưng theo China Daily, họ hiện đang hợp tác với nhiều nhà sản xuất bán dẫn như Huawei, Cambricon Technologies và Moore Threads.
Cũng trong ngày 27/8, Cambricon xác nhận đạt khả năng tương thích "ngay từ ngày đầu" trong việc phục vụ GLM-5.3-Flash. Moore Threads cũng cho biết đã hỗ trợ "từ đầu" cho mô hình AI mới này.
SCMP đánh giá, việc sử dụng chip nội địa "đánh dấu thử nghiệm quan trọng về khả năng của Trung Quốc trong việc xử lý khối lượng công việc suy luận quy mô lớn trên phần cứng tự sản xuất", trong bối cảnh nước này đang tìm cách giảm sự phụ thuộc vào các bộ xử lý tiên tiến từ Nvidia.

Giao diện website của Z.AI với mô hình GLM-5.3-Flash. Ảnh: Bảo Lâm
Theo Z.AI, với tổng cộng 320 tỷ tham số, GLM-5.3-Flash chỉ kích hoạt 18 tỷ tham số cho mỗi yêu cầu để giảm thiểu gánh nặng tính toán. Nhằm khắc phục dung lượng bộ nhớ và băng thông thấp vốn là điểm yếu của chip AI Trung Quốc, công ty đã xây dựng công cụ suy luận chuyên dụng, chia giai đoạn xử lý thành các nhóm tính toán quản lý độc lập. Việc điều chỉnh kiến trúc này giúp tăng gấp ba hiệu năng phục vụ so với thông thường, đưa hiệu quả phần cứng và chi phí trên mỗi token ngang bằng với các bộ tăng tốc Nvidia chính thống. Dù vậy, những tuyên bố này vẫn chưa được xác minh độc lập.
Token là đơn vị dữ liệu đầu vào cơ bản gồm từ, một phần của từ, ký tự hoặc dấu câu mà mô hình AI xử lý để tạo đầu ra. Theo Z.AI, sau khi triển khai trên OpenRouter và OpenCode, GLM-5.3-Flash đã xử lý 62.000 tỷ token trước khi chính thức ra mắt. Đây cũng là mô hình đầu tiên trong dòng GLM-5 có khả năng xử lý thông tin hình ảnh cùng với văn bản một cách tự nhiên.
Ghi nhận độc lập từ OpenRouter cho thấy hệ thống đã xử lý hơn 11.000 tỷ token trong ba ngày đầu, tương đương gần 31% tổng khối lượng giao dịch hàng tuần. Công ty đánh giá hiệu năng Artificial Analysis đã chấm 57 điểm cho mô hình này, xếp thứ 10 toàn cầu và thứ ba trong số các mô hình trọng số mở, chỉ sau Kimi K3 của Moonshot AI và Qwen3.8 2.4T A95B của Alibaba – tất cả đều là các sản phẩm từ Trung Quốc.
Z.AI hiện chào hàng GLM-5.3-Flash với mức giá cạnh tranh để thu hút các nhà phát triển trong nước lẫn quốc tế. Chi phí để chạy 1 triệu token là 0,15 USD cho đầu vào và 0,5 USD cho đầu ra, bằng 1/10 so với GLM-5.3 tiêu chuẩn, thậm chí bằng 1/20 trong chương trình khuyến mãi, và khoảng 1/40 so với Opus 4.8 của Anthropic "ở mức độ thông minh tương đương". TechCrunch nhận định, sự xuất hiện của Ox Alpha càng làm tăng khả năng các mô hình giá rẻ, hiệu quả của Trung Quốc sẽ chiếm thị phần đáng kể từ những công ty phát triển mô hình tiên tiến đắt tiền của Mỹ như OpenAI và Anthropic.
Theo CNBC, cổ phiếu Z.AI đã tăng hơn 12% sau phiên giao dịch ngày 27/8 trên sàn chứng khoán Hong Kong.
Dù ghi nhận lượng truy cập cao trong thời gian dùng thử miễn phí, phản hồi ban đầu từ các nhà phát triển lại khá trái chiều. Một số người khen ngợi khả năng gỡ lỗi mã phức tạp của mô hình, khi giải quyết được 28% trong số 175 bài toán trên công cụ đánh giá năng lực lập trình LiveCodeBench. Patrick Collison, CEO hãng công nghệ Stripe, đã dùng thử mô hình và nhận xét là "rất ấn tượng".
Tuy nhiên, nhiều lập trình viên cho biết AI vẫn xảy ra hiện tượng "ảo giác", các tác vụ bị bỏ dở hoặc quá trình tạo code diễn ra chậm chạp. Artificial Analysis cũng đánh giá tốc độ dữ liệu của mô hình này "chậm hơn mức trung bình của ngành".
Z.AI (Zhipu AI) được thành lập năm 2019 tại Bắc Kinh, phát triển từ nhóm nghiên cứu thuộc Đại học Thanh Hoa. Công ty chủ yếu tập trung phát triển mô hình ngôn ngữ lớn và các sản phẩm AI dòng GLM (General Language Model), là một trong những startup AI Trung Quốc nhận được sự đầu tư từ các quỹ và doanh nghiệp công nghệ trong nước.
Bảo Lâm tổng hợp
Bài viết được AI dịch và tổng hợp tự động từ VnExpress Khoa học Công nghệ. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.