Mô hình
Qwen3.8-Flash-Next ra mắt: Mô hình 125B tối ưu hiệu suất với công nghệ N-gram
(giờ Việt Nam)
Nguyên văn trên X
Big thanks to @sgl_project for the day-0 support! 🙌 Qwen3.8-Flash-Next is ready to deploy with SGLa…
Dịch · tóm tắt AI
Alibaba trình làng Qwen3.8-Flash-Next, mô hình 125B sử dụng 51B N-gram embedding giúp tăng dung lượng mà không tốn thêm chi phí tính toán. SGLang đã hỗ trợ triển khai ngay lập tức cho kiến trúc này.
Bài viết được AI dịch và tổng hợp tự động từ X: Qwen (@Alibaba_Qwen). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.