Mô hình
Ra mắt Qwen3.8-Flash-Next: Mô hình MoE đa phương thức mã nguồn mở, hé lộ kiến trúc Qwen4
(giờ Việt Nam)
Tóm tắt AI
Qwen giới thiệu mô hình MoE đa phương thức Qwen3.8-Flash-Next với 125B tham số (kích hoạt 6B), mang lại hiệu suất vượt trội và là bước đệm cho kiến trúc Qwen4. Người dùng đã có thể trải nghiệm các phiên bản lượng tử hóa tối ưu trên nền tảng Unsloth.
Bản dịch AI
26 tháng 8 năm 2026 - Link Blog
Qwen3.8-Flash-Next (via) Một mô hình open weights khác từ Qwen. Đây là "một mô hình MoE đa phương thức, đồng thời đóng vai trò là bản xem trước sớm cho kiến trúc sẽ được sử dụng trong Qwen4".
Mô hình này khá lớn: 125B tham số, nhưng chỉ có 6B tham số hoạt động, điều này giúp nó đạt được sự gia tăng đáng kể về hiệu suất.
Tôi đã thử nghiệm nó trên DGX Spark bằng cách sử dụng các mô hình đã được lượng tử hóa của Unsloth. Tôi vẫn đang khám phá mô hình này - cho đến nay tôi đã thử phiên bản UD-IQ1_S dung lượng 72.5GB (tạo ra những hình ảnh chim bồ nông này) và phiên bản UD-Q2_K_XL dung lượng 78.9GB (tạo ra những hình ảnh này).
Phiên bản tôi ưng ý nhất cho đến nay là kết quả từ nỗ lực suy luận xhigh của UD-Q2_K_XL:

Bài viết được AI dịch và tổng hợp tự động từ Simon Willison Blog. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.