Zhipu ra mắt mô hình đa phương thức thuần túy GLM-5.3-Flash
Tổng quan sự kiện
Toàn cảnh do AI tổng thuật
Ngày 26/8/2026, Zhipu chính thức ra mắt và mở mã nguồn GLM-5.3-Flash (320B-A18B). Đây là mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5, với tổng tham số 320B và tham số kích hoạt chỉ 18B. Mô hình hỗ trợ cửa sổ ngữ cảnh 1M-token và được phát hành theo giấy phép MIT. Trong bài kiểm tra chỉ số thông minh tổng hợp AA, mô hình đạt 57 điểm, ngang bằng với Claude Opus 4.8 và có hiệu suất lập trình tương đương.
Trước đó, mô hình này từng được xem trước trên OpenRouter với tên mã Ox Alpha. Chỉ trong 6 ngày, nó đã xử lý hơn 20 nghìn tỷ token, trở thành mô hình lớn nhất từng xuất hiện trên OpenRouter. Hiện tại, mô hình đã được tích hợp vào các nền tảng như HuggingFace, API, ZCode, SiliconFlow và vận hành hoàn toàn trên các cụm chip AI nội địa.
Về giá cả, GLM-5.3-Flash có mức phí bằng 1/10 so với GLM-5.3, giá ưu đãi giới hạn bằng 1/20 so với GLM-5.3 và bằng 1/40 so với Claude Opus 4.8. Mô hình sử dụng kiến trúc kết hợp giữa cơ chế chú ý thưa (sparse attention) và cơ chế chú ý tuyến tính (linear attention).
Theo báo cáo mới nhất, mô hình này đạt 57 điểm trên chỉ số thông minh của Artificial Analysis với cường độ suy luận tối đa, chỉ thấp hơn GLM-5.3 ba điểm và ngang bằng với GPT-5.6 Terra cùng Muse Spark 1.2. Ngoài ra, các báo cáo cho biết lưu lượng truy cập trực tuyến của mô hình này hoàn toàn vận hành trên 100 nghìn chip nội địa. Trước khi ra mắt, mô hình ẩn danh Ox Alpha đã xử lý 62 nghìn tỷ token trên OpenRouter và OpenCode; các nhà cung cấp chip có thể bao gồm Huawei, Hygon và Moore Threads.
Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T5 · 27/08 · 21:13.
Diễn biến mới nhất
GLM-5.3-Flash đã chính thức có mặt trên SiliconFlow với chi phí giảm hơn 90%.
Chính chủ · 5 bài
Nghe trực tiếp từ bên liên quan
- X: SiliconFlow (@SiliconFlowAI)GLM-5.3-Flash chính thức mã nguồn mở trên SiliconFlow
- Zhipu AI: Nghiên cứu (Web dữ liệu)GLM-5.3-Flash: Kỷ nguyên trí tuệ tiên phong cho mọi người
Dòng thời gian đưa tin
Đang hiện 14 bài · tất cả · mới trước
T5 · 27/08
GLM-5.3-Flash chính thức mã nguồn mở trên SiliconFlow
X: SiliconFlow (@SiliconFlowAI)Chính chủOx-Alpha đã chính thức lộ diện. Hãy làm quen với GLM-5.3-Flash từ @Zai_org — hiện đã mã nguồn mở và có mặt trên SiliconFlow. Hỗ trợ Day-0 như thường lệ. Tổng cộng 320 tỷ tham số, với 18 tỷ tham số kích hoạt. Đa phương thức nguyên bản. Giấy phép MIT. Giúp trí tuệ tiên tiến trở nên dễ tiếp cận hơn. Mạnh mẽ hơn GLM-5.2. Chi phí giảm 90%. Hiệu suất trong các tác vụ lập trình và tác tử (agent) tiệm cận với Opus 4.8, trong khi chi phí giảm hơn 95%. Trên SiliconFlow: tối ưu hóa suy luận, độ khả dụng cao, năng lực vận hành ở quy mô sản xuất. Hãy bắt đầu xây dựng trên SiliconFlow ngay hôm nay.
Zhipu AI ra mắt mã nguồn mở GLM-5.3-Flash, vận hành trên chip nội địa
X: X.PIN (@thexpin)Ngày 26/8, Zhipu AI đã công bố mã nguồn mở cho GLM-5.3-Flash, mẫu mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5. Toàn bộ lưu lượng truy cập trực tuyến của mô hình này được vận hành trên 100 nghìn chip nội địa. Trước khi ra mắt, một mô hình ẩn danh có tên "Ox Alpha" đã xử lý 62 nghìn tỷ token trên OpenRouter và OpenCode – cũng sử dụng phần cứng từ Trung Quốc. Theo các báo cáo, các nhà cung cấp chip có thể bao gồm Huawei, Hygon và Moore Threads. Trên bảng xếp hạng Artificial Analysis, mô hình này đạt 57 điểm, ngang bằng với Claude Opus 4.8, trong khi chi phí chỉ bằng 1/10 so với GLM-5.3. Mô hình mở, sức mạnh tính toán nội địa, nhu cầu toàn cầu.
Ra mắt GLM-5.3-Flash: 320 tỷ tham số, cửa sổ ngữ cảnh 1 triệu token, chi phí chỉ bằng khoảng 1/7,5 so với GLM-5.3
The Decoder: AI NewsZ.ai vừa phát hành GLM-5.3-Flash với tổng cộng 320 tỷ tham số (18 tỷ tham số kích hoạt), hỗ trợ cửa sổ ngữ cảnh 1 triệu token và được cấp phép mã nguồn mở theo chuẩn MIT. Trên bảng xếp hạng Intelligence Index, mô hình này đạt 57 điểm, tiệm cận mức 60 điểm của GLM-5.3, nhưng chi phí mỗi tác vụ chỉ là 0,09 USD, tương đương khoảng 1/7,5 so với phiên bản tiền nhiệm. Mô hình này vận hành hoàn toàn trên chip AI nội địa, với phần mềm dịch vụ do Z.ai tự phát triển, mang lại hiệu suất tương đương với GPU của Nvidia.
GLM-5.3-Flash: Kỷ nguyên trí tuệ tiên phong cho mọi người
Zhipu AI: Nghiên cứu (Web dữ liệu)Chính chủZhipu AI vừa ra mắt và mã nguồn mở GLM-5.3-Flash (320B-A18B). Đây là mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5, đạt 57 điểm trong chỉ số trí tuệ tổng hợp AA, ngang bằng với Claude Opus 4.8. Mức giá của mô hình này chỉ bằng 1/10 so với GLM-5.3 (thời gian giới hạn là 1/20) và bằng 1/40 so với Opus 4.8. Đáng chú ý, đây là lần đầu tiên sức mạnh tính toán cho lưu lượng truy cập quy mô lớn được hỗ trợ bởi các cụm chip nội địa. Mô hình hiện đã được tích hợp vào các nền tảng như ZCode và mở quyền truy cập API.
Zhipu ra mắt GLM-5.3-Flash, mô hình ẩn danh OX Alpha chính thức lộ diện
Công chúng hào: KhazixZhipu vừa chính thức phát hành GLM-5.3-Flash, chính là mô hình ẩn danh OX Alpha từng gây sốt trên OpenRouter và OpenCode trước đó. Mô hình này sở hữu kiến trúc MoE với 320 tỷ tham số tổng và 18 tỷ tham số kích hoạt. Đây là mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5, hỗ trợ đầu vào dạng hình ảnh, video và văn bản, với cửa sổ ngữ cảnh gốc lên tới 1 triệu token.
Z.ai ra mắt GLM-5.3-Flash: Mô hình MoE đa phương thức thuần túy với 320 tỷ tham số tổng (18 tỷ tham số kích hoạt), hỗ trợ cửa sổ ngữ cảnh 1 triệu token
MarkTechPostZ.ai vừa phát hành GLM-5.3-Flash, mẫu mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5. Mô hình sở hữu 320 tỷ tham số tổng, 18 tỷ tham số kích hoạt, hỗ trợ đầu vào là hình ảnh/video cùng cửa sổ ngữ cảnh lên tới 1 triệu token. Trọng số của mô hình đã được mở nguồn theo giấy phép MIT trên Hugging Face.
Ra mắt GLM-5.3-Flash: Đỉnh cao hiệu năng với chi phí tối ưu
X: Artificial Analysis (@ArtificialAnlys)Zhipu vừa công bố GLM-5.3-Flash với tổng cộng 320 tỷ tham số và 18 tỷ tham số kích hoạt. Trên bảng xếp hạng chỉ số thông minh của Artificial Analysis, mô hình này đạt 57 điểm ở cường độ suy luận tối đa, chỉ thấp hơn GLM-5.3 đúng 3 điểm và ngang bằng với GPT-5.6 Terra cùng Muse Spark 1.2.
T4 · 26/08
Zhipu AI ra mắt mô hình đa phương thức mã nguồn mở GLM-5.3-Flash
X: Testing Catalog (@testingcatalog)ZHIPU AI 🔥: GLM-5.3-Flash (tên mã Ox Alpha) đã chính thức ra mắt! > GLM-5.3-Flash là mô hình đa phương thức 320B-A18B. > Sử dụng giấy phép MIT. > Trước đây có tên là Ox Alpha, từng là một mô hình ẩn danh trên OpenRouter. Có vẻ như GLM-5.3-Flash và Gemini 3.7 Flash thực sự là "đôi bạn cùng tiến".
Ra mắt GLM-5.3 Flash: Hiệu suất đáng kinh ngạc với 18B tham số kích hoạt
X: Kim (@kimmonismus)GLM-5.3 Flash (Ox Alpha) chính thức ra mắt với kiến trúc MoE 320B, chỉ kích hoạt 18B tham số mỗi token, mã nguồn mở theo giấy phép MIT, hỗ trợ đa phương thức gốc và cửa sổ ngữ cảnh 1M token.
Ra mắt GLM-5.3-Flash: Đa phương thức với ngữ cảnh 1M token
X: Elvis Saravia (@omarsar0, DAIR.AI)Zhipu AI ra mắt GLM-5.3-Flash, hỗ trợ đa phương thức gốc và cửa sổ ngữ cảnh 1M token, với hiệu năng đối trọng Opus-4.8. Mô hình 320B-A18B này được phát hành dưới giấy phép MIT, trước đó có tên mã là Ox Alpha, vận hành hoàn toàn trên chip AI nội địa và hiện đã có mặt trên mọi nền tảng như HuggingFace, API.
GLM-5.3-Flash mã nguồn mở: Tổng tham số 320B, chỉ số AA đạt 57 điểm, giá bằng 1/40 so với Opus 4.8
Công chúng hào: Zhipu AI (GLM)Chính chủZhipu ra mắt và mở mã nguồn GLM-5.3-Flash (320B-A18B), mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5. Với chỉ số thông minh tổng hợp AA đạt 57 điểm, mô hình ngang bằng với Claude Opus 4.8. Mức giá của GLM-5.3-Flash bằng 1/10 so với GLM-5.3, và trong thời gian ưu đãi chỉ bằng 1/40 so với Opus 4.8. Hiện mô hình đã được tích hợp trên các nền tảng như ZCode để mở API. Mô hình sử dụng kiến trúc kết hợp giữa cơ chế chú ý thưa và tuyến tính, với dịch vụ suy luận đã được vận hành trên các cụm chip nội địa.
OpenRouter công bố mô hình đa phương thức GLM-5.3-Flash
X: OpenRouter (@OpenRouter)Chính chủOx Alpha chính thức lộ diện: GLM-5.3-Flash từ @Zai_org, mô hình đa phương thức thuần túy đầu tiên trong dòng GLM-5. Ox Alpha là mô hình lớn nhất từng có trên OpenRouter, xử lý hơn 20 nghìn tỷ token chỉ trong 6 ngày. Trải nghiệm ngay mô hình tại: https://openrouter.ai/z-ai/glm-5.3-flash
Zhipu ra mắt GLM-5.3-Flash, mô hình 320B mã nguồn mở theo giấy phép MIT
X: Zhipu AI Z.ai (@Zai_org)Chính chủZhipu ra mắt GLM-5.3-Flash, mô hình đa phương thức thuần túy (native multimodal), hỗ trợ cửa sổ ngữ cảnh 1 triệu token, với 320 tỷ tham số tổng và 18 tỷ tham số kích hoạt, đồng thời được mã nguồn mở theo giấy phép MIT. Trước đó, mô hình này từng được xem trước dưới tên mã Ox Alpha, chạy hoàn toàn trên chip AI nội địa và hiện đã có mặt trên tất cả các nền tảng như HuggingFace, API với ưu thế về hiệu năng trên giá thành.
Zhipu mở mã nguồn mô hình đa phương thức thuần túy GLM-5.3-Flash, với giá ưu đãi trong thời gian giới hạn chỉ bằng 1/20 so với GLM-5.3
IT HomeZhipu ra mắt và mở mã nguồn GLM-5.3-Flash (320B-A18B), đây là mô hình đa phương thức thuần túy đầu tiên thuộc dòng GLM-5, với tổng tham số 320 tỷ và 18 tỷ tham số kích hoạt. Mô hình đạt 57 điểm trên chỉ số thông minh tổng hợp AA, ngang bằng với Claude Opus 4.8 và có hiệu suất lập trình tương đương. Mức giá niêm yết bằng 1/10 so với GLM-5.3, giá ưu đãi giới hạn là 1/20, và chỉ bằng 1/40 so với Opus 4.8. Mô hình đã được tích hợp vào các nền tảng như ZCode và mở quyền truy cập API.