← Về bảng nóng
SỰ KIỆNĐang theo dõi

DeepSeek ra mắt DeepSeek-V4.1-Flash: Thúc đẩy hiệu suất triển khai tác nhân (agent) ngữ cảnh dài với CSA2 và nén bộ nhớ đệm KV FP4

Tổng quan sự kiện

Tóm tắt sự kiện · Thông tin xác thực

DeepSeek ra mắt mô hình MoE đa phương thức DeepSeek-V4.1-Flash với 552 tỷ tham số (kích hoạt 16 tỷ/8 tỷ). Thông qua kỹ thuật tái sử dụng bộ nhớ đệm KV liên tầng CSA2 và bộ nhớ đệm KV FP4, mô hình đã giảm bộ nhớ đệm KV toàn cục xuống còn 890 byte mỗi token (khoảng 1/4 so với V4-Flash), đồng thời giảm bộ nhớ đệm bền vững xuống còn khoảng 1/8 nhờ SWA Bounded Replay. Mô hình được huấn luyện trước trên 45 nghìn tỷ token dữ liệu đa phương thức và các điểm kiểm tra (checkpoint) đã được công khai trên Hugging Face.

Theo bài gốc của sự kiện từ HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng).

Diễn biến mới nhất

Tác giả thăm dò các cổng Engram của V4.1 Flash và phát hiện các mô hình văn bản của nó vượt xa phạm vi tên gọi và sự kiện thông thường.

Chính chủ · 2 bài

Nghe trực tiếp từ bên liên quan

Lọc toàn bộ bài chính chủ trong dòng thời gian →

Dòng thời gian đưa tin

Đang hiện 5 bài · tất cả · mới trước

Hôm nay · 26/09

  1. OpenCode thông báo hạn mức 60 USD cho DeepSeek V4.1 Flash trên OpenCode Go sẽ có hiệu lực vĩnh viễn

    IT Home

    OpenCode tuyên bố khởi động giai đoạn hai của "Operation Cheepseek", chuyển đổi hạn mức sử dụng 60 USD cho DeepSeek V4.1 Flash trên OpenCode Go từ hình thức giới hạn thời gian sang hiệu lực vĩnh viễn. Trước đó, hạn mức này đã được nâng tạm thời từ 15 USD lên 60 USD (gấp 4 lần tiêu chuẩn ban đầu) và dự kiến kết thúc vào ngày 20 tháng 9; hiện tại trang Go đã hiển thị mức 60 USD, trong khi hạn mức 15 USD cũ đã bị gạch bỏ.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Tác giả thăm dò các cổng Engram của V4.1 Flash và phát hiện các mô hình văn bản của nó vượt xa phạm vi tên gọi và sự kiện thông thường

    X: SemiAnalysis (@SemiAnalysis_)

    Một tác giả giấu tên đã thăm dò các cổng Engram của V4.1 Flash để tìm hiểu cách mô hình này sử dụng các mô hình văn bản; kết quả cho thấy các mô hình này không chỉ dừng lại ở tên gọi hay sự kiện, tài liệu còn đề cập đến việc bộ nhớ của DeepSeek có phản hồi với "Wright: Ace Attorney".

    Đọc bản tiếng Việt →Đọc bài gốc ↗

Hôm qua · 25/09

  1. Operation Cheepseek Giai đoạn 2: Hạn mức sử dụng 60 USD cho DeepSeek v4.1 Flash hiện đã trở thành vĩnh viễn

    X: opencode (@opencode)Chính chủ

    Hạn mức sử dụng 60 USD cho DeepSeek v4.1 Flash hiện đã có hiệu lực vĩnh viễn; văn bản gốc không nêu rõ đơn vị công bố.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T4 · 23/09

  1. DeepSeek-V4.1-Flash được miễn phí sử dụng trong thời gian giới hạn trên nền tảng WorkBuddy, ưu đãi kéo dài đến ngày 9 tháng 10

    X: Tencent WorkBuddy (@WorkBuddy_AI)Chính chủ

    Theo thông báo gốc, mô hình DeepSeek-V4.1-Flash được mở miễn phí trong thời gian giới hạn trên nền tảng WorkBuddy, ưu đãi sẽ kéo dài đến ngày 9 tháng 10, người dùng có thể sử dụng mô hình này để hoàn thành các tác vụ trong thời gian ưu đãi.

    Đọc bản tiếng Việt →Đọc bài gốc ↗

T5 · 17/09

  1. DeepSeek ra mắt DeepSeek-V4.1-Flash: Thúc đẩy hiệu suất triển khai tác nhân (agent) ngữ cảnh dài với CSA2 và nén bộ nhớ đệm KV FP4

    HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)

    DeepSeek ra mắt mô hình MoE đa phương thức DeepSeek-V4.1-Flash với 552 tỷ tham số (kích hoạt 16 tỷ/8 tỷ). Thông qua kỹ thuật tái sử dụng bộ nhớ đệm KV liên tầng CSA2 và bộ nhớ đệm KV FP4, mô hình đã giảm bộ nhớ đệm KV toàn cục xuống còn 890 byte mỗi token (khoảng 1/4 so với V4-Flash), đồng thời giảm bộ nhớ đệm bền vững xuống còn khoảng 1/8 nhờ SWA Bounded Replay. Mô hình được huấn luyện trước trên 45 nghìn tỷ token dữ liệu đa phương thức và các điểm kiểm tra (checkpoint) đã được công khai trên Hugging Face.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT ↗

DeepSeek ra mắt DeepSeek-V4.1-Flash: Thúc đẩy hiệu suất triển khai tác nhân (agent) ngữ cảnh dài với CSA2 và nén bộ nhớ đệm KV FP4 — Hồ sơ sự kiện | AIHOT.vn