Mô hình DeepSeek-V4.1-Flash chính thức có mặt trên nền tảng SiliconFlow (Ngày 0)
Tổng quan sự kiện
Toàn cảnh do AI tổng thuật
Ngày 10/9, DeepSeek đã ra mắt mô hình V4.1 Flash, phiên bản có kích thước nhỏ nhất trong dòng cấu trúc mô hình hoàn toàn mới, sở hữu khả năng hiểu thị giác đa phương thức nguyên bản. Mô hình này sử dụng kiến trúc MoE với 552B tham số, cấu trúc bộ mã hóa-giải mã nhân quả (causal encoder-decoder) có đầu vào và đầu ra bất đối xứng, với 8B tham số kích hoạt ở đầu vào và 16B ở đầu ra. Mô hình hỗ trợ cửa sổ ngữ cảnh 1M tokens và được phát hành theo giấy phép MIT.
Về hiệu năng, mô hình đạt kết quả ấn tượng trong nhiều bài kiểm tra tiêu chuẩn. Theo báo cáo từ Artificial Analysis, mô hình đạt 40 điểm trên Intelligence Index, vượt qua thế hệ tiền nhiệm DeepSeek V4 Pro 0813 (1.6T tham số) trong khi chi phí chỉ bằng khoảng một phần tư. Trên AutomationBench-AA, mô hình đồng hạng nhất với GPT-6 Astra với tỉ lệ 69%. Ngoài ra, mô hình đạt 27% trên Terminal-Bench v4.0 và 84% trên AA-LCR v1.1.
Về chi phí và hiệu suất, giá API chính thức của DeepSeek là 0,30 USD cho mỗi triệu token đầu vào và 1,20 USD cho mỗi triệu token đầu ra, giá token đầu vào trong bộ nhớ đệm (cache) thấp tới 0,006 USD (giảm giá 98%). Theo phân tích từ Hong Ming, thay đổi then chốt của bản cập nhật này là việc cắt giảm đáng kể KV Cache, giúp nhu cầu HBM giảm xuống còn một phần tư và nhu cầu SSD giảm xuống còn một phần tám so với thế hệ trước. DeepSeek dự kiến sẽ chuyển hướng các yêu cầu của V4 Pro sang V4.1 Flash sau ngày 14/9 và áp dụng biểu giá mới. Nền tảng SiliconFlow đã tích hợp mô hình này ngay trong ngày ra mắt (Ngày 0).
Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T6 · 11/09 · 20:15.
Diễn biến mới nhất
Xem chi tiết toàn cảnh sự việc tại đây.
Chính chủ · 1 bài
Nghe trực tiếp từ bên liên quan
- X: SiliconFlow (@SiliconFlowAI)DeepSeek-V4.1-Flash đã có mặt trên SiliconFlow, mô hình MoE 552B hỗ trợ cửa sổ ngữ cảnh 1 triệu token
Dòng thời gian đưa tin
Đang hiện 4 bài · tất cả · mới trước
T6 · 11/09
DeepSeek thông báo tiếp tục cung cấp API V4 Pro, hủy bỏ kế hoạch ngừng dịch vụ vào ngày 14/9
IT HomeDeepSeek thông báo sẽ tiếp tục cung cấp dịch vụ gọi API cho DeepSeek V4 Pro sau ngày 14/9/2026 với phương thức tính phí không đổi. Trước đó, DeepSeek từng có kế hoạch chuyển toàn bộ yêu cầu V4 Pro sang V4.1 Flash và tính phí theo đơn giá của mô hình mới, sau đó thông báo hoãn thời điểm ngừng dịch vụ đến 12:00 ngày 14/9. Giá cho mỗi triệu token đầu ra của V4 Pro vào giờ cao điểm là 27,0 nhân dân tệ.
Ra mắt DeepSeek V4.1 Flash: KV Cache thu nhỏ 437 lần
X: Hongming (@hongming731)DeepSeek ra mắt mô hình MoE 552B tham số V4.1 Flash, sử dụng cấu trúc Causal Encoder Decoder với đầu vào và đầu ra bất đối xứng, kích hoạt 8B tham số đầu vào và 16B tham số đầu ra, hỗ trợ nguyên bản khả năng hiểu thị giác đa phương thức.
DeepSeek V4.1 Flash ra mắt, vượt qua DeepSeek V4 Pro 0813 với 40 điểm để trở thành flagship mới
X: Artificial Analysis (@ArtificialAnlys)Đánh giá từ Artificial Analysis cho thấy DeepSeek V4.1 Flash đạt 40 điểm trên Intelligence Index, vượt qua DeepSeek V4 Pro 0813 để trở thành flagship mới của DeepSeek, với 8B tham số kích hoạt đầu vào, 16B tham số kích hoạt đầu ra, hỗ trợ 1M token ngữ cảnh và giấy phép MIT.
T5 · 10/09
DeepSeek-V4.1-Flash đã có mặt trên SiliconFlow, mô hình MoE 552B hỗ trợ cửa sổ ngữ cảnh 1 triệu token
X: SiliconFlow (@SiliconFlowAI)Chính chủSiliconFlow thông báo DeepSeek-V4.1-Flash đã được tích hợp lên nền tảng của họ ngay trong ngày ra mắt (Day 0). Đây là mô hình MoE 552B với khoảng 8 tỷ tham số kích hoạt cho quá trình prefill và khoảng 16 tỷ tham số kích hoạt cho quá trình decode. Mô hình hỗ trợ thị giác máy tính nguyên bản, cửa sổ ngữ cảnh 1 triệu token, mức tiêu thụ bộ nhớ đệm KV chỉ bằng 1/4 so với bản V4 Flash và được phát hành theo giấy phép MIT.