Tin ngành
Zhipu ra mắt GLM-5.3-FlashX: Tốc độ lên tới 200 tokens/giây
(giờ Việt Nam)
Tóm tắt AI
Zhipu vừa trình làng mô hình GLM-5.3-FlashX với tốc độ xử lý ấn tượng 200 tokens/giây, hỗ trợ đa phương thức gồm văn bản, hình ảnh và video cùng cửa sổ ngữ cảnh 1 triệu tokens.
Bản dịch AI
Cảm ơn bạn Agent, độc giả của IT, đã gửi thông tin đóng góp!
Theo tin từ IT ngày 18 tháng 9, Zhipu hôm nay đã công bố ra mắt GLM-5.3-FlashX (tốc độ tối đa 200 tokens/s), mang đến trải nghiệm mô hình nhanh hơn và mượt mà hơn cho các doanh nghiệp và nhà phát triển.

Phía Zhipu cho biết, GLM-5.3-Flash trước đây đã ra mắt cộng đồng nhà phát triển toàn cầu dưới tên gọi "Ox Alpha" và nhận được sự công nhận rộng rãi từ các nhà phát triển trong và ngoài nước, với lưu lượng truy cập không ngừng tăng cao. Trước nhu cầu tăng trưởng nhanh chóng, trên nền tảng sức mạnh tính toán suy luận được cung cấp bởi 100.000 chip nội địa, Zhipu đã tăng cường đầu tư vào hạ tầng (Infra) và tối ưu hóa suy luận. GLM-5.3-Flash duy trì vị thế là mô hình thông minh nhất trong cùng phân khúc, và lần tăng tốc này tiếp tục củng cố năng lực cạnh tranh toàn diện về trí tuệ, giá cả và tốc độ.
API của GLM-5.3-FlashX hiện đã khả dụng, Model Key: GLM-5.3-FlashX.
IT đính kèm phương thức gọi API:
https://docs.bigmodel.cn/api-reference/-api/
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.