DeepSeek ra mắt DeepSeek-V4-Flash-Vision-Exp
Tổng quan sự kiện
Toàn cảnh do AI tổng thuật
Vào ngày 21 tháng 8 năm 2026, DeepSeek đã công bố mô hình hiểu thị giác đa phương thức thử nghiệm DeepSeek-V4-Flash-Vision-Exp và đưa lên nền tảng API. Mô hình này có khả năng xử lý văn bản thuần túy ngang bằng với phiên bản chính thức V4-Flash, đồng thời ghi nhận bước nhảy vọt về hiệu suất trong các bài kiểm tra Agent hiểu thị giác, tiệm cận với Opus-4.8.
API tính phí theo token, mỗi hình ảnh chiếm tối đa 384 tokens, mức giá tương đương với V4-Flash, hỗ trợ ba định dạng gọi và ba phương thức truyền tải hình ảnh. Người dùng có thể truy cập bằng cách thiết lập model='deepseek-v4-flash-vision-exp'.
Tài khoản X chính thức bổ sung thêm rằng khả năng xử lý văn bản của mô hình này bao gồm các tác vụ về tác nhân (agent), suy luận và kiến thức thế giới. Các bài đánh giá từ bên thứ ba cho thấy hiệu suất của mô hình đa phương thức đang tiệm cận với Opus-4.8, với kết quả đạt 27,3 so với 25,7 trong bài kiểm tra Agents Last Exam, và 35,0 so với 34,0 trong ZeroBench.
Theo báo cáo mới nhất, mô hình này tương thích với API của OpenAI và Anthropic, hỗ trợ ba phương thức tải ảnh gồm Base64, URL (32 MiB) và Files API miễn phí (64 MiB), với khả năng xử lý tối đa 600 ảnh trong một yêu cầu.
Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T7 · 22/08 · 03:01.
Diễn biến mới nhất
Bổ sung khả năng tương thích với API của OpenAI/Anthropic, cho phép gửi tối đa 600 ảnh trong một yêu cầu.
Chính chủ · 2 bài
Nghe trực tiếp từ bên liên quan
- X: DeepSeek (@deepseek_ai)DeepSeek ra mắt mô hình đa phương thức V4-Flash-Vision-Exp
- DeepSeek: Nhật ký cập nhật APIDeepSeek-V4-Flash-Vision-Exp chính thức ra mắt
Dòng thời gian đưa tin
Đang hiện 5 bài · tất cả · mới trước
T7 · 22/08
DeepSeek ra mắt mô hình thị giác thử nghiệm V4-Flash-Vision-Exp, đạt điểm chuẩn tác tử (agent) ngang ngửa Opus 4.8
The Decoder: AI NewsDeepSeek vừa phát hành mô hình đa phương thức thử nghiệm V4-Flash-Vision-Exp, duy trì khả năng suy luận văn bản trên nền tảng hiểu hình ảnh, với kết quả kiểm thử tác tử nội bộ tiệm cận Opus 4.8. Mô hình này tương thích với API của OpenAI và Anthropic, hỗ trợ ba phương thức truyền tải hình ảnh gồm Base64, URL (32 MiB) và Files API miễn phí (64 MiB). Chi phí tối đa cho mỗi hình ảnh là 384 tokens, với giới hạn 600 hình ảnh cho mỗi yêu cầu.
T6 · 21/08
DeepSeek ra mắt mô hình đa phương thức, chi phí xử lý 100 hình ảnh chưa đến 20 cent
X: AI Notes (@AYi_AInotes)DeepSeek phát hành mô hình đa phương thức thử nghiệm deepseek-v4-flash-vision-exp. Mô hình này có khả năng xử lý văn bản tương đương V4-Flash, hiệu suất tác tử (Agent) đa phương thức tiệm cận Opus-4.8, với điểm số 27,3 so với 25,7 trong bài kiểm tra Agents Last Exam và 35,0 so với 34,0 trong ZeroBench.
DeepSeek ra mắt mô hình đa phương thức V4-Flash-Vision-Exp
X: DeepSeek (@deepseek_ai)Chính chủDeepSeek giới thiệu mô hình đa phương thức thử nghiệm DeepSeek-V4-Flash-Vision-Exp, với khả năng xử lý văn bản ngang bằng V4-Flash, bao gồm các tác vụ về tác nhân thông minh (agent), suy luận và kiến thức thế giới.
DeepSeek-V4-Flash-Vision-Exp chính thức ra mắt
DeepSeek: Nhật ký cập nhật APIChính chủDeepSeek đưa mô hình hiểu thị giác đa phương thức thử nghiệm DeepSeek-V4-Flash-Vision-Exp lên nền tảng API, người dùng có thể truy cập bằng cách thiết lập model='deepseek-v4-flash-vision-exp'.
DeepSeek V4-Flash-Vision-Exp chính thức lên sóng, mở dịch vụ API đa phương thức
IT HomeDeepSeek công bố mô hình hiểu thị giác đa phương thức DeepSeek-V4-Flash-Vision-Exp và đã đưa lên nền tảng API. Mô hình này có khả năng xử lý văn bản thuần túy ngang bằng với phiên bản chính thức V4-Flash, hiệu suất trong các bài kiểm tra Agent hiểu thị giác tăng mạnh, tiệm cận với Opus-4.8. API tính phí theo token, mỗi hình ảnh chiếm tối đa 384 tokens, mức giá tương đương với V4-Flash, hỗ trợ ba định dạng gọi và ba phương thức truyền tải hình ảnh.