Sản phẩm
Alibaba Cloud: Chip Zhenwu tối ưu hóa thành công cho Qwen 3.8, chính thức cung cấp dịch vụ suy luận trên nền tảng Bailian
(giờ Việt Nam)
Tóm tắt AI
Alibaba Cloud thông báo chip Zhenwu đã tương thích hoàn toàn với mô hình Qwen 3.8. Người dùng hiện có thể truy cập và sử dụng dịch vụ suy luận của mô hình này thông qua nền tảng điện toán đám mây Bailian.
Bản dịch AI
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
23/07/2026 14:58:23 Nguồn: QbitAI
Tin ngày 23 tháng 7, siêu nút (super-node) Zhenwu M890 của Alibaba đã thích ứng thành công với Qwen3.8 và chính thức có mặt trên nền tảng Alibaba Cloud Bailian để cung cấp dịch vụ suy luận mô hình. Đây là siêu nút đầu tiên tại Trung Quốc vận hành thành công mô hình ngôn ngữ lớn với hơn 2 nghìn tỷ tham số.
Qwen3.8 là mô hình chủ lực mới nhất của Alibaba với quy mô lên tới 2,4 nghìn tỷ tham số. Để vận hành một mô hình có quy mô như vậy, cần phải phân tán các tham số trên hàng chục, thậm chí hàng trăm card GPU được kết nối tốc độ cao, giúp các tham số nghìn tỷ "chạy ổn định và nhanh chóng". Tuy nhiên, các cụm AI thông thường do hạn chế về băng thông truyền tải nên không thể đáp ứng được các yêu cầu về thông lượng cao, độ trễ thấp và khả năng xử lý đồng thời lớn.
Zhenwu M890 là dòng chip AI tích hợp huấn luyện và suy luận thế hệ mới của T-Head, hỗ trợ nguyên bản nhiều độ chính xác dữ liệu từ FP32 đến FP4, có thể ứng dụng trong mọi kịch bản từ huấn luyện độ chính xác cao đến suy luận độ chính xác thấp và siêu thấp. Thông qua chip kết nối ICN Switch 1.0, các thực thể siêu nút Zhenwu cho phép 64 chip Zhenwu M890 đạt tốc độ kết nối cao 800GB/s với dung lượng bộ nhớ đồ họa lên tới 9TB, giúp một thực thể duy nhất có thể đáp ứng nhu cầu song song chuyên gia (expert parallelism) của mô hình MoE quy mô lớn 2 nghìn tỷ tham số.
Ngoài ra, Alibaba còn thực hiện tối ưu hóa toàn trình từ cấp độ chip đến nền tảng đám mây với mô hình Qwen, không chỉ giúp Qwen3.8 vận hành mượt mà mà còn nâng cao đáng kể hiệu suất suy luận và giảm chi phí. Dữ liệu đo lường thực tế cho thấy, thông qua việc tối ưu hóa toán tử và phối hợp kiến trúc phần cứng - phần mềm, thực thể siêu nút này có thể đạt mức tăng hiệu suất suy luận lên tới 1,5 lần trong các kịch bản suy luận Agentic.
Bài viết do Alibaba cung cấp, QbitAI được ủy quyền đăng tải lại, quan điểm thuộc về tác giả gốc.
Bản quyền đã được bảo hộ, nghiêm cấm sao chép và sử dụng dưới mọi hình thức khi chưa được cho phép, mọi hành vi vi phạm sẽ bị xử lý theo pháp luật.






Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.