OpenRouter vừa cập nhật hướng dẫn sử dụng API để gửi hình ảnh tới các mô hình đa phương thức. Bạn có thể truyền dữ liệu qua URL công khai hoặc định dạng base64 trong mảng tin nhắn, hỗ trợ tốt các định dạng phổ biến như PNG, JPEG, WebP và GIF.
DeepSeek V4-Pro chính thức trình làng với khả năng suy luận linh hoạt và hỗ trợ API chuẩn OpenAI. Đặc biệt, hãng giới thiệu mô hình giá theo giờ cao điểm/thấp điểm, giúp giảm 50% chi phí API vào khung giờ thấp điểm từ ngày 16/08/2026.
DeepSeek thông báo tăng giá API gấp ba lần và triển khai cơ chế giá linh hoạt theo khung giờ. Mức giá thấp hơn sẽ áp dụng vào giờ thấp điểm, trong khi giờ cao điểm (9h-12h và 14h-18h) sẽ có chi phí cao hơn, chính thức áp dụng từ ngày 17/8/2026.
Từ ngày 17/8, DeepSeek triển khai biểu giá API theo khung giờ cao điểm và thấp điểm. Giá trong khung giờ thấp điểm sẽ giảm một nửa so với giờ cao điểm, giúp người dùng tối ưu chi phí vận hành.
DịchOpenAI vừa giới thiệu chế độ siêu tốc cho GPT-5.6 Sol, giúp tăng tốc độ xử lý lên gấp 14 lần. Tính năng này hiện đang được triển khai thử nghiệm cho một nhóm khách hàng API trước khi mở rộng quy mô.
OpenAI vừa giới thiệu GPT-5.6 Sol với chế độ siêu tốc (ultrafast), giúp tăng hiệu suất xử lý lên tới 14 lần. Tính năng này hiện đang được triển khai thử nghiệm cho nhóm khách hàng doanh nghiệp chọn lọc qua API.
DeepSeek vừa ra mắt mô hình V4 Pro mạnh mẽ hơn, đồng thời điều chỉnh tăng giá API gấp 11 lần để tối ưu chi phí vận hành và thúc đẩy lộ trình mở rộng quy mô.
DeepSeek vừa công bố biểu giá API mới cho dòng V4 với mức tăng lên đến 500% trong giờ cao điểm, đồng thời ra mắt phiên bản V4-Pro-0813 với hiệu suất lập trình vượt trội.
DeepSeek-V4-Pro với 1,6 nghìn tỷ tham số đã chính thức phát hành, hỗ trợ API OpenAI và tối ưu cho GPU nội địa. Người dùng có thể trải nghiệm qua chế độ chuyên gia với cơ chế giá linh hoạt từ ngày 17/8.
DịchOpenAI vừa giới thiệu chế độ 'Ultrafast' cho mô hình GPT-5.6 Sol, giúp tăng tốc độ phản hồi lên tới 14 lần. Tính năng này hiện đang được triển khai thử nghiệm cho nhóm khách hàng doanh nghiệp chọn lọc trước khi mở rộng quy mô.
Thêm 6 nguồn khác đưa tinX: Greg Brockman (@gdb)X: Sam Altman (@sama)The Decoder: AI NewsHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeJiqizhixin
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)@deepseek_ai
DeepSeek vừa công bố mô hình định giá mới cho dòng V4, giảm tới 50% chi phí trong khung giờ thấp điểm nhằm tối ưu hóa hiệu quả vận hành cho người dùng. Chính sách này sẽ chính thức áp dụng từ 16:00 UTC ngày 16/08/2026.
OpenAI giới thiệu tầng dịch vụ API Ultrafast hợp tác cùng Cerebras, cho phép mô hình GPT-5.6 Sol đạt tốc độ phản hồi ấn tượng lên tới 750 tokens/giây, hiện đã mở bản xem trước.
Thêm 11 nguồn khác đưa tinX: OpenAI (@OpenAI)The Decoder: AI NewsX: Greg Brockman (@gdb)X: Sam Altman (@sama)Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeJiqizhixinX: Tibo (@thsottiaux)TechCrunch: AIX: Testing Catalog (@testingcatalog)X: Kim (@kimmonismus)
DeepSeek chính thức đưa V4-Pro ra khỏi giai đoạn thử nghiệm với hiệu suất vượt trội trên các bài kiểm tra kỹ thuật, đồng thời công bố mở mã nguồn phần mềm AI Agent và điều chỉnh tăng giá API.
The winners of our API Hackathon, all built in a weekend with Runway Dev, our API platform for build…
DịchRunway vừa vinh danh 3 dự án xuất sắc nhất được phát triển chỉ trong một cuối tuần trên nền tảng Runway Dev, bao gồm công cụ biến video tĩnh thành câu chuyện tương tác, mô phỏng hội thoại y tế và sửa lỗi tính liên tục trong video AI.
DeepSeek-V4-Pro GA officially announced! Yesterday's leaked benchmarks were real: The model now su…
DịchDeepSeek-V4-Pro và V4-Flash vừa được cập nhật tính năng tùy chỉnh cường độ suy luận (thấp/cao/tối đa), đồng thời hỗ trợ chuẩn OpenAI Responses API giúp tích hợp dễ dàng hơn.
DeepSeek thông báo áp dụng cơ chế giá theo khung giờ từ ngày 17/8/2026, với chi phí giờ cao điểm đắt gấp đôi giờ thấp điểm. Mức giá cho model deepseek-v4-pro có thể lên tới 27 tệ/triệu token đầu ra.
We're launching DeepSeek-V4-Pro today! 🚀 🔷 Major Agent upgrades with strong production gains! 🔷 …
DịchDeepSeek chính thức trình làng V4-Pro và V4-Flash, hỗ trợ tùy chỉnh cường độ suy luận linh hoạt cho từng loại tác vụ và tích hợp sẵn OpenAI Responses API để dễ dàng triển khai.
DeepSeek triển khai cơ chế giá linh hoạt cho API với mức phí giờ thấp điểm chỉ bằng một nửa giờ cao điểm. Chính sách này chính thức có hiệu lực từ 00:00 ngày 17/8.
DeepSeek vừa cập nhật model V4 Pro với khả năng hỗ trợ Responses API và gọi công cụ, cung cấp cửa sổ ngữ cảnh 1 triệu token cùng mức giá cạnh tranh cho người dùng API.
DeepSeek vừa ra mắt phiên bản V4 Pro 0813 trên OpenRouter với khả năng suy luận hình ảnh độc đáo. Dù hiện tại chỉ hỗ trợ API, cộng đồng kỳ vọng hãng sẽ sớm công khai mã nguồn như các phiên bản trước.
DeepSeek V4 Pro (bản 0813) vừa cập nhật API với khả năng vượt trội, nâng cấp mạnh mẽ tính năng Agent và hỗ trợ tích hợp Codex, đạt hiệu suất tiệm cận Fable 5.
DeepSeek vừa phát hành phiên bản V4 Pro trên nền tảng API, hỗ trợ cửa sổ ngữ cảnh 1 triệu token cùng bộ công cụ chuyên dụng cho nhà phát triển, với mức giá cao gấp 3 lần so với bản Flash.
DeepSeek V4 Pro vừa cập nhật phiên bản chính thức trên API với khả năng xử lý Agent vượt trội, hỗ trợ Codex và Responses API. Mức giá cạnh tranh cùng hiệu năng tiệm cận Fable 5 hứa hẹn tạo cú hích lớn cho cộng đồng lập trình.
Trang tài liệu API của DeepSeek vừa bổ sung model DeepSeek-V4-Pro-0813, hỗ trợ cả chế độ suy luận và không suy luận. Dù chưa có thông báo chính thức, đây được xem là bước tiến tiếp theo sau khi bản Flash ra mắt vào cuối tháng 7.
Objectively one of the coolest papers in LLM jailbreak world but most people didn't read the actual …
DịchChuyên gia Deedy Das làm rõ rằng các cuộc tấn công khai thác lỗ hổng API để trích xuất suy luận ẩn không hiệu quả với mô hình Fable, bác bỏ các tuyên bố trước đó về việc giải mã quá trình chưng cất mô hình này.
this is already one of the most important papers of this year. https://www.latent.space/p/ainews-ho...
DịchMột nghiên cứu gây chấn động khi tìm ra lỗ hổng API cho phép trích xuất các bước suy luận ẩn của các mô hình AI lớn. Phát hiện này xác nhận số lượng token suy luận thực tế khớp hoàn toàn với dữ liệu tính phí, mở ra góc nhìn mới về cách các mô hình AI vận hành bên trong.
You're paying for the same tokens twice. Every API call reloads the same context: system prompts, do…
DịchTính năng bộ nhớ đệm ngữ cảnh (Context Caching) mới trên Model Studio giúp bạn tránh việc phải trả phí lặp lại cho các dữ liệu đầu vào cố định như system prompt hay tài liệu, từ đó tiết kiệm đáng kể chi phí sử dụng API.
Nền tảng MaaS của Zhipu ghi nhận sự tăng trưởng mạnh mẽ với gần 7 triệu người dùng API. Để đáp ứng nhu cầu suy luận ngày càng cao, công ty đã kích hoạt thêm hơn 50.000 chip AI sản xuất trong nước.
Phiên bản 0.5a0 của plugin này bổ sung API chính thức, cho phép người dùng tải lên hoặc thay thế cơ sở dữ liệu SQLite trên Datasette một cách tự động. Tính năng này hỗ trợ tích hợp CI/CD, giúp cập nhật dữ liệu sản phẩm ngay sau khi build từ GitHub Actions.
Các nhà nghiên cứu phát hiện lỗ hổng cho phép giải mã và đánh cắp các chuỗi suy luận ẩn của Anthropic, OpenAI và Google thông qua việc phát lại dữ liệu. Dù đã được các nhà cung cấp khắc phục, đây là cảnh báo quan trọng về bảo mật dữ liệu trong các mô hình AI suy luận.