← Về bảng nóng
SỰ KIỆNĐã lắng xuống

Mô hình DeepSeek-V4.1-Flash chính thức có mặt trên nền tảng SiliconFlow (Ngày 0)

Tổng quan sự kiện

Toàn cảnh do AI tổng thuật

Ngày 10/9, DeepSeek đã ra mắt mô hình V4.1 Flash, phiên bản có kích thước nhỏ nhất trong dòng cấu trúc mô hình hoàn toàn mới, sở hữu khả năng hiểu thị giác đa phương thức nguyên bản. Mô hình này sử dụng kiến trúc MoE với 552B tham số, cấu trúc bộ mã hóa-giải mã nhân quả (causal encoder-decoder) có đầu vào và đầu ra bất đối xứng, với 8B tham số kích hoạt ở đầu vào và 16B ở đầu ra. Mô hình hỗ trợ cửa sổ ngữ cảnh 1M tokens và được phát hành theo giấy phép MIT.

Về hiệu năng, mô hình đạt kết quả ấn tượng trong nhiều bài kiểm tra tiêu chuẩn. Theo báo cáo từ Artificial Analysis, mô hình đạt 40 điểm trên Intelligence Index, vượt qua thế hệ tiền nhiệm DeepSeek V4 Pro 0813 (1.6T tham số) trong khi chi phí chỉ bằng khoảng một phần tư. Trên AutomationBench-AA, mô hình đồng hạng nhất với GPT-6 Astra với tỉ lệ 69%. Ngoài ra, mô hình đạt 27% trên Terminal-Bench v4.0 và 84% trên AA-LCR v1.1.

Về chi phí và hiệu suất, giá API chính thức của DeepSeek là 0,30 USD cho mỗi triệu token đầu vào và 1,20 USD cho mỗi triệu token đầu ra, giá token đầu vào trong bộ nhớ đệm (cache) thấp tới 0,006 USD (giảm giá 98%). Theo phân tích từ Hong Ming, thay đổi then chốt của bản cập nhật này là việc cắt giảm đáng kể KV Cache, giúp nhu cầu HBM giảm xuống còn một phần tư và nhu cầu SSD giảm xuống còn một phần tám so với thế hệ trước. DeepSeek dự kiến sẽ chuyển hướng các yêu cầu của V4 Pro sang V4.1 Flash sau ngày 14/9 và áp dụng biểu giá mới. Nền tảng SiliconFlow đã tích hợp mô hình này ngay trong ngày ra mắt (Ngày 0).

Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T6 · 11/09 · 20:15.

Diễn biến mới nhất

Xem chi tiết toàn cảnh sự việc tại đây.

Chính chủ · 1 bài

Nghe trực tiếp từ bên liên quan

Lọc toàn bộ bài chính chủ trong dòng thời gian →

Dòng thời gian đưa tin

Đang hiện 4 bài · tất cả · mới trước

T6 · 11/09

  1. DeepSeek thông báo tiếp tục cung cấp API V4 Pro, hủy bỏ kế hoạch ngừng dịch vụ vào ngày 14/9

    IT Home

    DeepSeek thông báo sẽ tiếp tục cung cấp dịch vụ gọi API cho DeepSeek V4 Pro sau ngày 14/9/2026 với phương thức tính phí không đổi. Trước đó, DeepSeek từng có kế hoạch chuyển toàn bộ yêu cầu V4 Pro sang V4.1 Flash và tính phí theo đơn giá của mô hình mới, sau đó thông báo hoãn thời điểm ngừng dịch vụ đến 12:00 ngày 14/9. Giá cho mỗi triệu token đầu ra của V4 Pro vào giờ cao điểm là 27,0 nhân dân tệ.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Ra mắt DeepSeek V4.1 Flash: KV Cache thu nhỏ 437 lần

    X: Hongming (@hongming731)

    DeepSeek ra mắt mô hình MoE 552B tham số V4.1 Flash, sử dụng cấu trúc Causal Encoder Decoder với đầu vào và đầu ra bất đối xứng, kích hoạt 8B tham số đầu vào và 16B tham số đầu ra, hỗ trợ nguyên bản khả năng hiểu thị giác đa phương thức.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  3. DeepSeek V4.1 Flash ra mắt, vượt qua DeepSeek V4 Pro 0813 với 40 điểm để trở thành flagship mới

    X: Artificial Analysis (@ArtificialAnlys)

    Đánh giá từ Artificial Analysis cho thấy DeepSeek V4.1 Flash đạt 40 điểm trên Intelligence Index, vượt qua DeepSeek V4 Pro 0813 để trở thành flagship mới của DeepSeek, với 8B tham số kích hoạt đầu vào, 16B tham số kích hoạt đầu ra, hỗ trợ 1M token ngữ cảnh và giấy phép MIT.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T5 · 10/09

  1. DeepSeek-V4.1-Flash đã có mặt trên SiliconFlow, mô hình MoE 552B hỗ trợ cửa sổ ngữ cảnh 1 triệu token

    X: SiliconFlow (@SiliconFlowAI)Chính chủ

    SiliconFlow thông báo DeepSeek-V4.1-Flash đã được tích hợp lên nền tảng của họ ngay trong ngày ra mắt (Day 0). Đây là mô hình MoE 552B với khoảng 8 tỷ tham số kích hoạt cho quá trình prefill và khoảng 16 tỷ tham số kích hoạt cho quá trình decode. Mô hình hỗ trợ thị giác máy tính nguyên bản, cửa sổ ngữ cảnh 1 triệu token, mức tiêu thụ bộ nhớ đệm KV chỉ bằng 1/4 so với bản V4 Flash và được phát hành theo giấy phép MIT.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT

Mô hình DeepSeek-V4.1-Flash chính thức có mặt trên nền tảng SiliconFlow (Ngày 0) — Hồ sơ sự kiện | AIHOT.vn