Sản phẩm
Alibaba ra mắt Qwen3.8-Flash: Tăng tốc độ xử lý gấp đôi, tiết kiệm 75% token
(giờ Việt Nam)
Tóm tắt AI
Alibaba vừa giới thiệu mô hình Qwen3.8-Flash với chế độ tiêu chuẩn mới, giúp tăng gấp đôi tốc độ tạo nội dung và giảm đáng kể chi phí token, tối ưu hóa mạnh mẽ cho các tác vụ văn phòng.
Bản dịch AI
Theo tin từ IT ngày 27 tháng 8, hôm nay, nền tảng Qianwen Office của Alibaba đã chính thức ra mắt mô hình Qwen3.8-Flash vừa được công bố, đồng thời giới thiệu chế độ tiêu chuẩn (Standard Mode).
Kể từ hôm nay, tất cả người dùng có thể trải nghiệm Qwen3.8-Flash thông qua chế độ tiêu chuẩn hoàn toàn mới. Dựa trên mô hình mới nhất này, người dùng có thể hoàn thành các tác vụ với mức tiêu thụ điểm (credit) ít hơn và tốc độ xử lý Token nhanh hơn. Trong tương lai, nguồn cung mô hình của Qianwen Office sẽ bao gồm hai chế độ: tiêu chuẩn và nâng cao. 95% các tác vụ hàng ngày có thể được hoàn thành thông qua chế độ tiêu chuẩn của Qianwen Office, chỉ 5% các tác vụ phức tạp mới cần sử dụng chế độ nâng cao.

Theo thông tin từ IT, sự cải thiện trong trải nghiệm người dùng đến từ việc nâng cấp mô hình và tối ưu hóa sự phối hợp của Agent. Với kiến trúc hoàn toàn mới, Qwen3.8-Flash sở hữu tổng tham số lên tới hàng trăm tỷ, đạt hiệu suất vượt trội so với Claude Opus 4.6.
Đồng thời, đội ngũ phát triển mô hình lớn Qianwen và đội ngũ Qianwen Office đã cùng ra mắt phiên bản Qwen3.8-Flash chuyên dụng cho văn phòng, được tinh chỉnh chuyên biệt cho các kịch bản như lập kế hoạch đa bước, lựa chọn công cụ, nén ngữ cảnh, đồng thời đạt được hiệu suất xử lý cao hơn thông qua tối ưu hóa suy luận và kiến trúc Harness tùy chỉnh.
Trong các bài kiểm tra tại môi trường văn phòng thực tế, tốc độ tạo nội dung cho mỗi tác vụ của chế độ tiêu chuẩn trên Qianwen Office đã tăng khoảng 100%, trong khi mức tiêu thụ Token giảm trung bình 75%.
Trong các kịch bản ứng dụng AI thực tế, hiệu suất cao thường đồng nghĩa với chi phí cao và độ trễ lớn, còn chi phí thấp thường phải đánh đổi bằng sự thông minh của mô hình. Sự tối ưu hóa phối hợp sâu giữa Agent và mô hình đang phá vỡ "tam giác bất khả thi" về hiệu suất, chi phí và tốc độ. Phía chính thức tuyên bố rằng, các Agent sắp sửa nói lời tạm biệt với nỗi lo về Token và bước vào kỷ nguyên "dồi dào, thỏa sức sử dụng".
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.