Nhóm Privatemode giới thiệu kỹ thuật không cần tinh chỉnh, tận dụng log probability của GLM-5.3-Flash để thực hiện các quyết định có kiểu dữ liệu cụ thể chỉ trong một lần forward pass.
DịchTừ ngày 3 đến 18/9, người dùng có thể trải nghiệm miễn phí GLM-5.3-Flash trên nền tảng ZCode trong 10 giờ mỗi ngày. Chương trình còn tặng 100M token cho người dùng mới và miễn phí gói Coding Plan trong 15 ngày.
Từ nay đến 20/9, người dùng gói GLM Coding Plan của Zhipu AI được miễn phí sử dụng mô hình GLM-5.3-Flash trong khung giờ từ 23h đêm đến 9h sáng hôm sau.
Mô hình GLM-5.3-Flash của Zhipu AI gây ấn tượng khi vận hành hoàn toàn trên chip AI nội địa Trung Quốc và đang nhanh chóng chiếm lĩnh các bảng xếp hạng hiệu năng cũng như lượt sử dụng.
Zhipu AI vừa trình làng mô hình GLM-5.3-Flash, đánh dấu bước tiến mới trong việc phổ cập trí tuệ nhân tạo nhờ sự hỗ trợ hạ tầng tính toán nội địa từ SenseTime.
Baidu Cloud đã hoàn tất tích hợp toàn diện mô hình đa phương thức GLM-5.3-Flash (320B-A18B) vào hệ sinh thái của mình, cho phép khách hàng doanh nghiệp và lập trình viên trải nghiệm ngay lập tức các tính năng mạnh mẽ tương đương Claude Opus 4.8.
GLM-5.3-Flash at 270 tok/s! Databricks inference team is on fire. So proud of the team! On our Off…
DịchGLM-5.3-Flash thiết lập chuẩn mực mới với tốc độ 270 tok/s, mang lại chất lượng vượt trội 10% so với bản tiền nhiệm nhưng chỉ tốn 1/10 chi phí vận hành.
Ox-Alpha🐮 has been revealed. 👀 Meet GLM-5.3-Flash from @Zai_org - now open source, and already liv…
DịchGLM-5.3-Flash là mô hình đa phương thức mã nguồn mở mới với 320B tham số (18B kích hoạt), mang lại khả năng lập trình và xử lý tác vụ thông minh ngang ngửa Opus 4.8 nhưng với chi phí giảm tới 95%. Hiện mô hình đã có mặt trên nền tảng SiliconFlow với khả năng suy luận tối ưu.
Moore Threads đã tối ưu hóa dòng card đồ họa MTT S5000 để hỗ trợ mô hình đa phương thức GLM-5.3-Flash, giúp tăng cường hiệu suất suy luận cho các ngữ cảnh dài thông qua kiến trúc MUSA.
Zhipu open-sourced GLM-5.3-Flash on Aug. 26, the GLM-5 series' first native multimodal model. Its on…
DịchZhipu AI vừa phát hành mã nguồn mở GLM-5.3-Flash, mô hình đa phương thức đầu tiên chạy hoàn toàn trên 100.000 chip nội địa Trung Quốc với hiệu suất ngang ngửa Claude Opus nhưng chi phí cực thấp.
Z.ai vừa trình làng GLM-5.3-Flash, mô hình mã nguồn mở chạy hoàn toàn trên chip nội địa với hiệu suất ngang ngửa GPU Nvidia nhưng chi phí vận hành chỉ bằng 1/7,5 so với bản tiền nhiệm.
Zhipu GLM-5.3-Flash vừa ra mắt với mức giá cạnh tranh và hiệu suất vượt trội, đánh bại DeepSeek V4 Flash trong hầu hết các bài kiểm tra benchmark, đặc biệt là khả năng xử lý hình ảnh.
Zhipu AI xác nhận mô hình ẩn danh 'Ox Alpha' chính là GLM-5.3-Flash, một mô hình Mixture-of-Experts tối ưu cho lập trình, tác vụ đại lý phức tạp và cửa sổ ngữ cảnh lên tới hàng triệu token.
Zhipu AI công bố mô hình ẩn danh 'Niu Lai' thực chất là GLM-5.3-Flash, được tối ưu hóa để chạy trên cụm 100.000 chip nội địa với hiệu suất ngang ngửa Nvidia.
Z.ai vừa trình làng GLM-5.3-Flash, mô hình đa phương thức mã nguồn mở chạy trên chip nội địa Trung Quốc với cửa sổ ngữ cảnh 1 triệu token, hứa hẹn hiệu suất lập trình vượt trội với chi phí tối ưu.
Zhipu AI vừa trình làng GLM-5.3-Flash, chính là mô hình ẩn danh OX Alpha từng gây sốt. Đây là mô hình đa phương thức gốc với kiến trúc MoE 320B, hỗ trợ xử lý hình ảnh, video và văn bản với cửa sổ ngữ cảnh lên tới 1 triệu token.
Z.ai trình làng GLM-5.3-Flash, mô hình đa phương thức gốc với 320 tỷ tham số, hỗ trợ xử lý hình ảnh, video và cửa sổ ngữ cảnh lên tới 1 triệu token, hiện đã mở mã nguồn theo giấy phép MIT.
GLM-5.3-Flash đạt 57 điểm trên Artificial Analysis, vượt xa mức trung bình 18 của các mô hình cùng phân khúc. Với cửa sổ ngữ cảnh 400k tokens và khả năng xử lý đa phương thức, đây là lựa chọn đáng chú ý về hiệu năng và giá thành.
GLM-5.3-Flash scores 57 on the Artificial Analysis Intelligence Index. At $0.09 Cost per Task, it si…
Dịchvừa trình làng GLM-5.3-Flash với 320B tham số, đạt 57 điểm trên bảng xếp hạng Artificial Analysis. Mô hình này gây ấn tượng mạnh khi sở hữu hiệu năng ngang ngửa các đối thủ lớn như GPT-5.6 Terra nhưng với chi phí vận hành tối ưu hơn.
Finally, Z.ai revealed that Ox Alpha was actually GLM-5.3-Flash. So that means over the last few d…
DịchZ.ai tiết lộ Ox Alpha chính là GLM-5.3-Flash, vận hành nhờ hàng chục nghìn chip AI nội địa thay vì cụm GPU NVIDIA, xử lý lưu lượng 100 nghìn tỷ token mỗi ngày.
GLM-5.3-Flash (formerly Ox Alpha) is now available on OpenCode Go with double usage for a limited ti…
DịchMô hình GLM-5.3-Flash (trước đây là Ox Alpha) đã được tích hợp vào nền tảng OpenCode Go, đi kèm chương trình khuyến mãi nhân đôi dung lượng sử dụng trong thời gian giới hạn.
ZHIPU AI 🔥: GLM-5.3-Flash (Ox Alpha) has been officially announced! > GLM-5.3-Flash is a 320B-A18B…
DịchZhipu AI chính thức phát hành GLM-5.3-Flash (trước đây là Ox Alpha), mô hình đa phương thức 320B-A18B theo giấy phép MIT, hứa hẹn hiệu năng cạnh tranh mạnh mẽ với Gemini 3.7 Flash.
vừa công bố GLM-5.3-Flash, mô hình đa phương thức đầu tiên thuộc dòng GLM-5 với 320 tỷ tham số. Sản phẩm đạt hiệu suất ngang ngửa Claude Opus 4.8 nhưng có giá thành cực kỳ cạnh tranh, hiện đã mở API cho các nhà phát triển.
Ox Alpha revealed: @Zai_org's GLM-5.3-Flash, the first native multimodal model in the GLM-5 series. …
DịchOpenRouter vừa giới thiệu GLM-5.3-Flash, mô hình đa phương thức gốc đầu tiên thuộc dòng GLM-5. Với hiệu suất ấn tượng, mô hình này đã xử lý hơn 20 nghìn tỷ token chỉ trong 6 ngày, trở thành mô hình lớn nhất từng xuất hiện trên nền tảng này.
Introducing GLM-5.3-Flash - Leading capabilities at a highly competitive price - Natively multimoda…
DịchZhipu AI vừa phát hành GLM-5.3-Flash, mô hình đa phương thức mạnh mẽ với 320 tỷ tham số, hỗ trợ cửa sổ ngữ cảnh 1 triệu token và hoàn toàn tương thích với chip AI nội địa.
Zhipu giới thiệu GLM-5.3-Flash, mô hình đa phương thức 320B với 18B tham số kích hoạt, đạt hiệu suất tương đương Claude Opus 4.8 nhưng có mức giá chỉ bằng 1/40.