Mô hình
Alibaba hé lộ Qwen3.8-Max: Mô hình đa phương thức 2,4 nghìn tỷ tham số đầy tham vọng
(giờ Việt Nam)
Tóm tắt AI
Alibaba vừa giới thiệu Qwen3.8-Max, mô hình MoE đa phương thức với 2,4 nghìn tỷ tham số, được tuyên bố có sức mạnh chỉ đứng sau Fable 5. Dù đã cho phép trải nghiệm sớm, hãng vẫn chưa công bố các thông số kỹ thuật chi tiết hay bảng điểm chuẩn cụ thể.
Bản dịch AI

Vào ngày 19 tháng 7, đội ngũ Qwen của Alibaba đã giới thiệu trước Qwen3.8-Max-Preview, sản phẩm chủ lực tiếp theo trong dòng Qwen. Nhóm nghiên cứu mô tả đây là mô hình có 2,4 nghìn tỷ tham số, "chỉ đứng sau Fable 5" trong số các hệ thống mà họ đã thực hiện đánh giá. Bản xem trước hiện đã khả dụng. Tuy nhiên, bảng đánh giá, thẻ mô hình (model card) và giấy phép vẫn chưa được công bố.
Thông báo ngày 19 tháng 7 năm 2026 được đưa ra trong khuôn khổ Hội nghị Trí tuệ Nhân tạo Thế giới (WAIC) tại Thượng Hải. Sự kiện này cũng diễn ra hai ngày sau khi Moonshot AI phát hành Kimi K3, một mô hình mã nguồn mở (open-weight) với 2,8 nghìn tỷ tham số. Thời điểm công bố cũng là một điểm nhấn quan trọng không kém gì bản thân mô hình.
Bài viết này phân tách những thông tin được Alibaba xác nhận và những thông tin chỉ dừng lại ở mức tuyên bố. Mọi số liệu hiệu suất dưới đây đều đi kèm với lưu ý này.
Những gì Qwen đã công bố
Tài khoản Qwen đăng tải rằng Qwen3.8 đang được ra mắt và sẽ sớm trở thành mô hình mã nguồn mở. Họ gọi đây là "một trong những mô hình mạnh mẽ nhất hiện nay, có thể so sánh với các hệ thống tiên phong hàng đầu."
Bản xem trước là có thật và có thể mua được. Quyền truy cập được thực hiện thông qua gói đăng ký Token Plan của Alibaba. Bản xem trước hiện được cung cấp với mức giá bằng 10% so với giá tiêu chuẩn.
Nhà phát triển Qwen, Shuai Bai, đã bổ sung các chi tiết kỹ thuật. Ông mô tả Qwen3.8 là mô hình đa phương thức đầu tiên của nhóm vượt ngưỡng 1 nghìn tỷ tham số. Nó có khả năng xử lý văn bản, hình ảnh, video và tài liệu. Đội ngũ Alibaba khẳng định mô hình này sẽ vượt trội hơn Qwen3.7-Max trong các tác vụ lập trình, phát triển full-stack, phân tích dữ liệu và quy trình làm việc văn phòng.
Công cụ giải thích tương tác
Công cụ giải thích tương tác của Marktechpost
Qwen3.8-Max-Preview: Những gì Alibaba xác nhận, những gì chỉ là tuyên bố
Một bản xem trước đa phương thức 2,4T tham số đã được phát hành trước khi có bất kỳ bảng đánh giá, thẻ mô hình hoặc giấy phép nào. Hãy khám phá các sự thật dưới đây.
Xác nhận so với Tuyên bố
Quy mô tham số
Công cụ tính chi phí phục vụ (serving-cost)
Dữ liệu cơ sở đã xác minh của 3.7-Max
Bản xem trước đã khả dụng và có thể mua. Qwen3.8-Max-Preview được bán thông qua Alibaba Token Plan, Qoder và QoderWork với mức giá bằng 10% giá tiêu chuẩn.
Kiến trúc Sparse Mixture-of-Experts, đa phương thức. Nhà phát triển Shuai Bai cho biết đây là mô hình đa phương thức đầu tiên của nhóm vượt ngưỡng 1T tham số, có khả năng xử lý hình ảnh, video và tài liệu.
Tương thích với giao thức của OpenAI và Anthropic. Các tác nhân lập trình (coding agents) hiện có có thể kết nối với Qwen3.8 mà không cần xây dựng lại hệ thống hỗ trợ.
2,4 nghìn tỷ tham số. Đây là con số do Alibaba tự đưa ra. Không có thẻ mô hình hay thông số kỹ thuật nào xác nhận điều này.
"Chỉ đứng sau Fable 5." Chưa có bảng đánh giá nào được công bố. Thứ hạng này dựa trên đánh giá nội bộ.
Mã nguồn mở "sắp ra mắt". Không có ngày cụ thể, không có giấy phép, không có kho lưu trữ trên Hugging Face. Hai mô hình chủ lực Max gần nhất của Alibaba đều được phát hành dưới dạng đóng.
Tham số hoạt động trên mỗi token. Chưa được tiết lộ — đây là con số duy nhất quyết định chi phí phục vụ thực tế cho một mô hình Sparse MoE.
Trạng thái tính đến ngày 19 tháng 7 năm 2026. Chuyển đổi loại thông tin bằng các tab phía trên.
Tổng số tham số, các mô hình tiên phong được công bố công khai, tháng 7 năm 2026. Con số 2,4T của Qwen3.8 là tuyên bố của Alibaba, không phải số liệu đã được xác minh.
Tổng số lượng không phải là khả năng tính toán thực tế. Một mô hình Sparse MoE chỉ kích hoạt một phần nhỏ các tham số này trên mỗi token.
Nếu mô hình 2,4T đầy đủ được phát hành dưới dạng mã nguồn mở, sẽ cần những gì để tải nó?
Chỉ tính riêng trọng số (weights)
Card Nvidia H200 (141GB)
Ước tính chỉ dành cho trọng số; cộng thêm khoảng 20–30% cho bộ nhớ đệm KV và chi phí vận hành (runtime overhead). Việc phục vụ dựa trên tham số hoạt động sẽ rẻ hơn nhiều, nhưng Alibaba chưa công bố con số đó.
Phiên bản tiền nhiệm đã được xác minh. Mọi con số về "khả năng" của Qwen3.8 được công bố thực chất vẫn là số liệu của Qwen3.7-Max cho đến khi Alibaba phát hành bảng đánh giá.
92,4
GPQA Diamond
80,4%
SWE-bench Verified
69,7
Terminal-Bench 2.0
1M
Cửa sổ ngữ cảnh (tokens)
$1,25


Bài viết được AI dịch và tổng hợp tự động từ MarkTechPost. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.