QbitAI
85

Mô hình

Qwen Office ra mắt Qwen3.8-Flash: Tốc độ tạo văn bản tăng gấp đôi, tiết kiệm 75% token

(giờ Việt Nam)

Tóm tắt AI

Qwen Office vừa tích hợp mô hình Qwen3.8-Flash mới nhất, mang lại hiệu suất vượt trội với tốc độ xử lý nhanh hơn 100% và tối ưu hóa đáng kể chi phí tiêu thụ token.

Bản dịch AI

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

27/08/2026 09:45:08 Nguồn: QbitAI

Tối ngày 26 tháng 8, Qianwen Office đã chính thức ra mắt mô hình Qwen3.8-Flash vừa được công bố, đồng thời giới thiệu chế độ tiêu chuẩn (standard mode).

Tối ngày 26 tháng 8, Qianwen Office đã chính thức ra mắt mô hình Qwen3.8-Flash vừa được công bố, đồng thời giới thiệu chế độ tiêu chuẩn. Kể từ hôm nay, tất cả người dùng có thể trải nghiệm Qwen3.8-Flash thông qua chế độ tiêu chuẩn hoàn toàn mới. Dựa trên mô hình mới nhất này, người dùng có thể hoàn thành các tác vụ với mức tiêu thụ điểm ít hơn và tốc độ xử lý Token nhanh hơn. Trong tương lai, nguồn cung mô hình của Qianwen Office sẽ chỉ bao gồm hai chế độ là tiêu chuẩn và nâng cao; 95% các tác vụ hàng ngày có thể được hoàn thành thông qua chế độ tiêu chuẩn của Qianwen Office, chỉ 5% các tác vụ phức tạp mới cần sử dụng chế độ nâng cao.

Sự cải thiện trong trải nghiệm người dùng đến từ việc nâng cấp mô hình và tối ưu hóa sự phối hợp của Agent. Với kiến trúc hoàn toàn mới, Qwen3.8-Flash sở hữu tổng tham số lên tới hàng trăm tỷ, đạt hiệu suất vượt trội so với Claude Opus 4.6. Đồng thời, đội ngũ phát triển mô hình lớn Qianwen và đội ngũ Qianwen Office đã cùng ra mắt phiên bản Qwen3.8-Flash dành riêng cho công việc, được huấn luyện và tinh chỉnh chuyên biệt cho các tình huống như lập kế hoạch đa bước, lựa chọn công cụ, nén ngữ cảnh, đồng thời hiện thực hóa việc tăng hiệu suất xử lý thông qua tối ưu hóa suy luận và kiến trúc Harness tùy chỉnh. Trong các bài kiểm tra thực tế tại môi trường văn phòng, tốc độ tạo nội dung cho mỗi tác vụ của chế độ tiêu chuẩn trên Qianwen Office đã tăng khoảng 100%, trong khi mức tiêu thụ Token giảm trung bình 75%.

Trong các ứng dụng AI thực tế, hiệu suất cao thường đồng nghĩa với chi phí cao và độ trễ lớn, còn chi phí thấp thường phải đánh đổi bằng trí thông minh của mô hình. Sự tối ưu hóa phối hợp sâu sắc giữa Agent và mô hình đang phá vỡ "tam giác bất khả thi" về hiệu suất, chi phí và tốc độ. Với mật độ thông minh của mô hình liên tục được nâng cao, cùng sự tối ưu hóa hai chiều giữa Qianwen Office và mô hình, các Agent sắp sửa nói lời tạm biệt với nỗi lo về Token và bước vào kỷ nguyên "dồi dào tài nguyên".

Bài viết này do Qianwen cung cấp, QbitAI đã được cấp phép đăng tải lại, quan điểm thuộc về tác giả gốc.

Bản quyền đã được bảo hộ, nghiêm cấm sao chép và sử dụng dưới mọi hình thức khi chưa được cấp phép, mọi hành vi vi phạm sẽ bị xử lý theo quy định.

量子位的朋友们
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ QbitAI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.