Mô hình
Zhipu ra mắt GLM-5.3-FlashX: Tốc độ suy luận đạt đỉnh 200 tokens/giây
(giờ Việt Nam)
Tóm tắt AI
Zhipu vừa trình làng GLM-5.3-FlashX với tối ưu hóa hạ tầng vượt trội, đạt tốc độ 200 tokens/giây trên nền tảng 100.000 chip nội địa. Mẫu model này hứa hẹn hiệu năng mạnh mẽ nhất trong phân khúc cùng chi phí tối ưu, hiện đã sẵn sàng trên API.
Bài viết được AI dịch và tổng hợp tự động từ : Zhipu AI (GLM). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.