Mô hình
DeepSeek-V4-Pro chính thức ra mắt: Nâng cấp mạnh mẽ khả năng tự hành (Agent)
(giờ Việt Nam)
Tóm tắt AI
DeepSeek-V4-Pro đã có mặt trên ứng dụng, web và API với hiệu suất vượt trội trong các tác vụ tự hành, đạt điểm số ấn tượng trong các bài kiểm tra HLE và Terminal Bench.
Bản dịch AI

Nhật ký cập nhật
Thời gian: 13-08-2026
Cập nhật DeepSeek-V4-Pro
Phiên bản chính thức của DeepSeek-V4-Pro đã được cập nhật đồng bộ trên APP, nền tảng web và API. Cách thức gọi API không thay đổi, chỉ cần đặt tên model là deepseek-v4-pro để sử dụng phiên bản mới nhất.
Năng lực Agent được cải thiện đáng kể
Phiên bản chính thức DeepSeek V4 Pro đã tăng cường đáng kể năng lực Agent, với hiệu suất thể hiện đặc biệt ấn tượng trong môi trường sản xuất.
Hỗ trợ nguyên bản Responses API
DeepSeek API hiện đã hỗ trợ nguyên bản định dạng OpenAI Responses API và được tinh chỉnh để tương thích với Codex. Người dùng có thể tham khảo tài liệu chính thức và sử dụng tập lệnh cấu hình một chạm để hoàn tất thiết lập Codex.
Kiểm soát cường độ suy luận linh hoạt hơn
Chế độ suy luận của V4-Pro và V4-Flash hiện hỗ trợ ba mức cường độ: low / high / max. Trong quá trình sử dụng thực tế, người dùng có thể lựa chọn linh hoạt tùy theo độ phức tạp của tác vụ: dùng low cho tác vụ đơn giản, high cho các tác vụ Agent hàng ngày và max cho các kịch bản tác vụ phức tạp hơn. Vui lòng tham khảo tài liệu API chính thức để biết cách thiết lập: Chế độ suy luận.
Điều chỉnh giá API
Cùng với việc ra mắt phiên bản chính thức của toàn bộ dòng model DeepSeek V4, chúng tôi sẽ cập nhật và điều chỉnh giá API. Để phân bổ tài nguyên hợp lý hơn, chúng tôi sẽ áp dụng định giá theo khung giờ cao điểm và thấp điểm; giá vào giờ thấp điểm sẽ bằng một nửa giá giờ cao điểm, nhằm khuyến khích người dùng điều chỉnh thời gian thực hiện tác vụ dựa trên nhu cầu thực tế. Mức giá mới sẽ có hiệu lực từ 0 giờ ngày 17 tháng 8 năm 2026 (giờ Bắc Kinh).
Thời gian: 31-07-2026
Cập nhật DeepSeek-V4-Flash
API phiên bản chính thức của DeepSeek-V4-Flash đã ra mắt bản thử nghiệm công khai (public beta). Cách thức gọi API không thay đổi, chỉ cần đặt tên model là deepseek-v4-flash để sử dụng phiên bản mới nhất.
Năng lực Agent được tăng cường mạnh mẽ, các bài kiểm tra benchmark vượt xa V4-Pro-Preview:
Chú thích 1: Đối với các tác vụ Code Agent trong tập dữ liệu benchmark công khai, phiên bản chính thức DeepSeek-V4-Flash sử dụng chế độ tối giản DeepSeek Harness (sắp ra mắt) làm khung thử nghiệm, với thiết lập mức max, topp=0.95, temperature=1.0. Chú thích 2: DSBench-FullStack là tập dữ liệu kiểm thử phát triển full-stack nội bộ, DSBench-Hard là tập dữ liệu kiểm thử các bài toán khó dành cho Coding Agent nội bộ.
Phiên bản chính thức V4-Flash hỗ trợ nguyên bản định dạng Responses API và được tinh chỉnh tương thích với Codex, vui lòng tham khảo tài liệu để biết cách cấu hình chi tiết.
Cấu trúc và kích thước model của DeepSeek-V4-Flash-0731 được giữ nguyên so với DeepSeek-V4-Flash-Preview, chỉ thực hiện tái huấn luyện hậu kỳ (post-training).
Lưu ý: Lần này chỉ nâng cấp giao diện API của DeepSeek-V4-Flash, API DeepSeek-V4-Pro và model trên APP/WEB không có thay đổi. Phiên bản chính thức DeepSeek-V4-Pro sẽ sớm được phát hành.
Thời gian: 24-04-2026
DeepSeek-V4
DeepSeek API đã hỗ trợ V4-Pro và V4-Flash, hỗ trợ giao diện OpenAI ChatCompletions và giao diện Anthropic. Khi truy cập model mới, base_url giữ nguyên, tham số model cần đổi thành deepseek-v4-pro hoặc deepseek-v4-flash.
Hai tên model cũ là deepseek-chat và deepseek-reasoner sẽ ngừng sử dụng sau ba tháng (24-07-2026). Trong giai đoạn hiện tại, hai tên model này lần lượt trỏ đến chế độ không suy luận và chế độ suy luận của deepseek-v4-flash.
Vui lòng tham khảo tài liệu để biết nội dung cập nhật chi tiết.
Thời gian: 01-12-2025
DeepSeek-V3.2
Cả deepseek-chat và deepseek-reasoner đều đã được nâng cấp lên DeepSeek-V3.2.
DeepSeek-V3.2-Speciale
Chúng tôi đã triển khai không chính thức dịch vụ API cho DeepSeek-V3.2-Speciale. Người dùng API có thể truy cập model này bằng cách thiết lập base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215". Giá API của model này không đổi, chỉ hỗ trợ chức năng đối thoại ở chế độ suy luận, không hỗ trợ gọi công cụ (tool calling), độ dài đầu ra tối đa mặc định là 128K, thời gian hỗ trợ đến hết 23:59 ngày 15-12-2025 (giờ Bắc Kinh).
Vui lòng tham khảo tài liệu để biết nội dung cập nhật chi tiết.
Thời gian: 29-09-2025
DeepSeek-V3.2-Exp
Cả deepseek-chat và deepseek-reasoner đều đã được nâng cấp lên DeepSeek-V3.2-Exp.
Vui lòng tham khảo tài liệu để biết nội dung cập nhật chi tiết.
Thời gian: 22-09-2025
DeepSeek-V3.1-Terminus
Cả deepseek-chat và deepseek-reasoner đều đã được nâng cấp lên DeepSeek-V3.1-Terminus. Trong đó, deepseek-chat tương ứng với chế độ không suy luận của DeepSeek-V3.1-Terminus, còn deepseek-reasoner tương ứng với chế độ suy luận của DeepSeek-V3.1-Terminus.
Bản cập nhật này, bên cạnh việc duy trì các năng lực vốn có của model, đã thực hiện cải tiến dựa trên các vấn đề phản hồi từ người dùng, bao gồm:
Bài viết được AI dịch và tổng hợp tự động từ DeepSeek: API. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.