Mô hình
DeepSeek V4.1 Flash chính thức cập bến hạ tầng Siêu máy tính Quốc gia
(giờ Việt Nam)
Tóm tắt AI
Mô hình MoE 552B tham số DeepSeek V4.1 Flash đã được tích hợp vào mạng lưới siêu máy tính quốc gia, cho phép người dùng truy cập API với hiệu suất vượt trội so với phiên bản Pro.
Bản dịch AI
Theo tin từ IT ngày 10 tháng 9, mô hình DeepSeek V4.1 Flash đã chính thức có mặt trên Trung tâm Internet Siêu máy tính Quốc gia (National Supercomputing Internet Center). Người dùng có thể đăng nhập vào trang web chính thức của Trung tâm Internet Siêu máy tính Quốc gia, truy cập trang "Dịch vụ mô hình" (Model Service) từ trang chủ để mở nhanh giao diện gọi API của mô hình DeepSeek V4.1 Flash.

Theo tìm hiểu của IT, DeepSeek V4.1 Flash là mô hình MoE với 552 tỷ tham số, sử dụng cấu trúc Causal-Encoder-Decoder hoàn toàn mới. Với thiết kế đầu vào và đầu ra bất đối xứng, mô hình chỉ kích hoạt 8 tỷ tham số cho đầu vào và 16 tỷ tham số cho đầu ra, giúp chi phí vận hành thấp hơn đáng kể so với các mô hình có cùng kích thước hiện nay.

Đồng thời, V4.1 Flash cũng áp dụng phương thức tiền huấn luyện mới và trải qua quá trình hậu huấn luyện (post-training) bằng học tăng cường (reinforcement learning) với quy mô lớn hơn. Trong các bài kiểm tra đánh giá (benchmark), mô hình đã vượt qua mức độ thông minh của hàng loạt mô hình flagship khác, bao gồm cả DeepSeek V4 Pro.
Ngoài ra, DeepSeek V4.1 Flash đã giảm đáng kể dung lượng bộ nhớ đệm KV Cache. So với thế hệ trước, nhu cầu về HBM giảm xuống còn 1/4 và nhu cầu về SSD giảm xuống còn 1/8. Trong các kịch bản sử dụng Agent, chi phí cho việc truy cập bộ nhớ đệm thường chiếm tỷ trọng cao, do đó việc nén KV Cache đã giúp giảm mạnh chi phí sử dụng cho các tác vụ dạng Agent.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.