DeepSeek ra mắt DeepSeek-V4.1-Flash: Thúc đẩy hiệu suất triển khai tác nhân (agent) ngữ cảnh dài với CSA2 và nén bộ nhớ đệm KV FP4
Tổng quan sự kiện
Tóm tắt sự kiện · Thông tin xác thực
DeepSeek ra mắt mô hình MoE đa phương thức DeepSeek-V4.1-Flash với 552 tỷ tham số (kích hoạt 16 tỷ/8 tỷ). Thông qua kỹ thuật tái sử dụng bộ nhớ đệm KV liên tầng CSA2 và bộ nhớ đệm KV FP4, mô hình đã giảm bộ nhớ đệm KV toàn cục xuống còn 890 byte mỗi token (khoảng 1/4 so với V4-Flash), đồng thời giảm bộ nhớ đệm bền vững xuống còn khoảng 1/8 nhờ SWA Bounded Replay. Mô hình được huấn luyện trước trên 45 nghìn tỷ token dữ liệu đa phương thức và các điểm kiểm tra (checkpoint) đã được công khai trên Hugging Face.
Theo bài gốc của sự kiện từ HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng).
Diễn biến mới nhất
Tác giả thăm dò các cổng Engram của V4.1 Flash và phát hiện các mô hình văn bản của nó vượt xa phạm vi tên gọi và sự kiện thông thường.
Chính chủ · 2 bài
Nghe trực tiếp từ bên liên quan
- X: opencode (@opencode)Operation Cheepseek Giai đoạn 2: Hạn mức sử dụng 60 USD cho DeepSeek v4.1 Flash hiện đã trở thành vĩnh viễn
- X: Tencent WorkBuddy (@WorkBuddy_AI)DeepSeek-V4.1-Flash được miễn phí sử dụng trong thời gian giới hạn trên nền tảng WorkBuddy, ưu đãi kéo dài đến ngày 9 tháng 10
Dòng thời gian đưa tin
Đang hiện 5 bài · tất cả · mới trước
Hôm nay · 26/09
OpenCode thông báo hạn mức 60 USD cho DeepSeek V4.1 Flash trên OpenCode Go sẽ có hiệu lực vĩnh viễn
IT HomeOpenCode tuyên bố khởi động giai đoạn hai của "Operation Cheepseek", chuyển đổi hạn mức sử dụng 60 USD cho DeepSeek V4.1 Flash trên OpenCode Go từ hình thức giới hạn thời gian sang hiệu lực vĩnh viễn. Trước đó, hạn mức này đã được nâng tạm thời từ 15 USD lên 60 USD (gấp 4 lần tiêu chuẩn ban đầu) và dự kiến kết thúc vào ngày 20 tháng 9; hiện tại trang Go đã hiển thị mức 60 USD, trong khi hạn mức 15 USD cũ đã bị gạch bỏ.
Tác giả thăm dò các cổng Engram của V4.1 Flash và phát hiện các mô hình văn bản của nó vượt xa phạm vi tên gọi và sự kiện thông thường
X: SemiAnalysis (@SemiAnalysis_)Một tác giả giấu tên đã thăm dò các cổng Engram của V4.1 Flash để tìm hiểu cách mô hình này sử dụng các mô hình văn bản; kết quả cho thấy các mô hình này không chỉ dừng lại ở tên gọi hay sự kiện, tài liệu còn đề cập đến việc bộ nhớ của DeepSeek có phản hồi với "Wright: Ace Attorney".
Hôm qua · 25/09
Operation Cheepseek Giai đoạn 2: Hạn mức sử dụng 60 USD cho DeepSeek v4.1 Flash hiện đã trở thành vĩnh viễn
X: opencode (@opencode)Chính chủHạn mức sử dụng 60 USD cho DeepSeek v4.1 Flash hiện đã có hiệu lực vĩnh viễn; văn bản gốc không nêu rõ đơn vị công bố.
T4 · 23/09
DeepSeek-V4.1-Flash được miễn phí sử dụng trong thời gian giới hạn trên nền tảng WorkBuddy, ưu đãi kéo dài đến ngày 9 tháng 10
X: Tencent WorkBuddy (@WorkBuddy_AI)Chính chủTheo thông báo gốc, mô hình DeepSeek-V4.1-Flash được mở miễn phí trong thời gian giới hạn trên nền tảng WorkBuddy, ưu đãi sẽ kéo dài đến ngày 9 tháng 10, người dùng có thể sử dụng mô hình này để hoàn thành các tác vụ trong thời gian ưu đãi.
T5 · 17/09
DeepSeek ra mắt DeepSeek-V4.1-Flash: Thúc đẩy hiệu suất triển khai tác nhân (agent) ngữ cảnh dài với CSA2 và nén bộ nhớ đệm KV FP4
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)DeepSeek ra mắt mô hình MoE đa phương thức DeepSeek-V4.1-Flash với 552 tỷ tham số (kích hoạt 16 tỷ/8 tỷ). Thông qua kỹ thuật tái sử dụng bộ nhớ đệm KV liên tầng CSA2 và bộ nhớ đệm KV FP4, mô hình đã giảm bộ nhớ đệm KV toàn cục xuống còn 890 byte mỗi token (khoảng 1/4 so với V4-Flash), đồng thời giảm bộ nhớ đệm bền vững xuống còn khoảng 1/8 nhờ SWA Bounded Replay. Mô hình được huấn luyện trước trên 45 nghìn tỷ token dữ liệu đa phương thức và các điểm kiểm tra (checkpoint) đã được công khai trên Hugging Face.