Mô hình
DeepSeek ra mắt DeepSeek-V4.1-Flash: Đột phá kiến trúc CED tối ưu bộ nhớ KV cache
(giờ Việt Nam)
Tóm tắt AI
DeepSeek-V4.1-Flash là mô hình MoE đa phương thức 552B tham số, sử dụng kiến trúc CED và kỹ thuật FP4 giúp giảm dung lượng KV cache xuống mức cực thấp, hỗ trợ ngữ cảnh lên tới 1 triệu token với hiệu suất vượt trội.

Bài viết được AI dịch và tổng hợp tự động từ X: NLP (@dongxi_nlp). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.