Mô hình
DeepSeek Flash mới: Hiệu năng ngang ngửa GPT-5.6 Luna với chi phí rẻ hơn 60%
(giờ Việt Nam)
Tóm tắt AI
Bản cập nhật "0731" giúp DeepSeek V4 Flash đạt 50 điểm trên bảng xếp hạng Artificial Analysis, bám sát GPT-5.6 Luna nhưng tiết kiệm tới 60% chi phí vận hành.
Bản dịch AI


31 tháng 7, 2026
Deepseek vừa ra mắt V4 Flash "0731", một bản nâng cấp lớn cho dòng mô hình AI giá rẻ của hãng. Theo chỉ số Artificial Analysis Intelligence Index, phiên bản mới đạt 50 điểm, cao hơn 10 điểm so với V4 Flash tiền nhiệm ra mắt vào tháng 4 năm 2026. Kết quả này giúp nó chỉ đứng sau mô hình giá rẻ GPT-5.6 Luna của OpenAI đúng một điểm, nhưng lại có chi phí thấp hơn khoảng 60% cho mỗi tác vụ, ngay cả sau khi OpenAI đã giảm giá 80%. Một lý do quan trọng tạo nên khoảng cách này là mức chiết khấu bộ nhớ đệm (cache) 98% của Deepseek, vượt xa mức tiêu chuẩn 90% của ngành. Mô hình này cũng sử dụng ít hơn 12% token so với phiên bản trước đó.

Mô hình này cải thiện ở mọi hạng mục thử nghiệm so với phiên bản cũ, với bước tiến lớn nhất nằm ở các tác vụ đại lý (agentic tasks). Trên GDPval, một bộ tiêu chuẩn đánh giá được thiết kế để kiểm tra khả năng xử lý các công việc văn phòng phức tạp trong thế giới thực, mô hình đã tăng từ 1.189 lên 1.559 điểm Elo. Nó cũng ít gặp tình trạng "ảo giác" (hallucination) hơn. Kiến trúc của mô hình vẫn được giữ nguyên: tổng cộng 284 tỷ tham số, 13 tỷ tham số hoạt động, với cửa sổ ngữ cảnh (context window) một triệu token. Trọng số của mô hình hiện đã có sẵn trên Hugging Face theo giấy phép MIT.
Tin tức AI không thổi phồng – Được biên soạn bởi con người
Đăng ký THE DECODER để đọc tin không quảng cáo, nhận bản tin AI hàng tuần, báo cáo độc quyền "AI Radar" về các công nghệ tiên phong sáu lần mỗi năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.