Qwen@Alibaba_QwenAPI is live on QwenCloud: https://www.qwencloud.com/models/qwen3.8-flash 🙌Let's build something!
DịchQwen3.8-Flash là mô hình đa phương thức 125B với kiến trúc MoE tối ưu, chỉ kích hoạt 6B tham số mỗi token nhưng vượt trội hoàn toàn so với bản tiền nhiệm. Đây là bước đệm cho kiến trúc Qwen4 với chi phí vận hành cực thấp và hỗ trợ ngữ cảnh lên tới 1 triệu token.
Diễn biến sự kiện · 5 bài →Thêm 15 nguồn khác đưa tinX: Alibaba Cloud (@alibaba_cloud)X: Hongming (@hongming731)PandailyX: OpenRouter (@OpenRouter)X: AI Notes (@AYi_AInotes)X: SemiAnalysis (@SemiAnalysis_)X: Elvis Saravia (@omarsar0, DAIR.AI)MarkTechPostThe Decoder: AI NewsX: Testing Catalog (@testingcatalog)IT HomeTechNodeSimon Willison BlogJiqizhixinX: Kim (@kimmonismus)
Vì sao đáng đọc: Đây là bước tiến quan trọng về tối ưu hóa chi phí và hiệu năng cho mô hình ngôn ngữ lớn, thu hút sự quan tâm lớn từ cộng đồng phát triển AI.