As we continue to push the frontier of capabilities while improving efficiency, we're dropping API a…
DịchNhằm tối ưu hóa hiệu suất và mở rộng khả năng tiếp cận, OpenAI thông báo sẽ giảm hơn 20% giá API và tín dụng cho mô hình GPT-5.6 Sol trong 3 tháng tới.
Thêm 10 nguồn khác đưa tinHacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)IT HomeX: Greg Brockman (@gdb)X: Elvis Saravia (@omarsar0, DAIR.AI)X: Testing Catalog (@testingcatalog)X: Kim (@kimmonismus)X: Rohan Paul (@rohanpaul_ai)X: OpenAI Developers (@OpenAIDevs)X: Tibo (@thsottiaux)smol.ai AI News
Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung)
Chi phí vận hành các mô hình ngôn ngữ lớn đang giảm mạnh, với tốc độ giảm 100 lần mỗi năm. Sự sụt giảm này biến những dự án phân tích dữ liệu quy mô lớn vốn bất khả thi trước đây trở nên khả thi và hiệu quả về mặt kinh tế.
Các nhà phát triển báo cáo một lỗ hổng nghiêm trọng trên AWS Bedrock khiến chi phí vận hành Codex tăng gấp 10 lần, gây xôn xao cộng đồng công nghệ. Hiện tại, nguyên nhân và trạng thái khắc phục của lỗi này vẫn chưa được công bố rõ ràng.
Open-source vs. frontier AI is usually a theoretical debate. @DataCamp has to make that choice in p…
DịchCEO và Giám đốc AI của DataCamp thảo luận về bài toán cân bằng giữa chi phí, hiệu suất, độ trễ và quyền riêng tư khi tích hợp AI vào nền tảng cho 19 triệu người dùng.
What % of global AI token spend do you think is people running evals?
DịchLogan Kilpatrick đặt ra câu hỏi thú vị về tỷ trọng thực tế của chi phí token dành cho các tác vụ đánh giá (evals) trong tổng ngân sách chi tiêu cho AI toàn cầu hiện nay.
Dù chỉ chiếm 30% tổng lượng token, Anthropic chiếm tới 65,1% chi phí trên Vercel AI Gateway, với giá mỗi token cao gấp 4,4 lần so với các đối thủ khác.
OpenRouter và Vercel đồng loạt giảm nửa giá cước API cho mô hình GPT-5.6 Sol, đưa mức phí xuống còn 2,5 USD cho đầu vào và 15 USD cho đầu ra mỗi triệu token nhằm thu hút người dùng.
OpenAI vừa cắt giảm 50% chi phí cho mô hình GPT-5.6 Sol, đưa giá đầu vào xuống còn 2,5 USD/1 triệu token. Mô hình này hỗ trợ cửa sổ ngữ cảnh 1 triệu token, tối ưu cho lập trình và các tác vụ suy luận phức tạp.
New data layer in OpenRouter and our API: Cost per Session Cost per session is a way of assessing t…
DịchOpenRouter vừa cập nhật lớp dữ liệu mới cho phép người dùng theo dõi chi phí thực tế trên mỗi phiên làm việc, giúp tối ưu hóa ngân sách khi so sánh hiệu suất giữa các mô hình như Kimi K3, Sol, Fable và Opus.
DeepSeek chính thức triển khai cơ chế giá API theo khung giờ cao điểm và thấp điểm với tỷ lệ 1:2. Mức phí cho V4-Pro ghi nhận biến động mạnh, tăng từ 50% đến 1.100% tùy thuộc vào loại mô hình và thời điểm sử dụng.
Từ ngày 17/8, DeepSeek chính thức áp dụng cơ chế giá theo khung giờ, trong đó chi phí sử dụng API vào giờ cao điểm (9h-12h và 14h-18h) sẽ đắt gấp đôi so với giờ thấp điểm.
DeepSeek has officially increased their prices OpenCode Go's limits have been updated to reflect th…
DịchDeepSeek vừa chính thức tăng giá API, kéo theo việc OpenCode Go phải cập nhật lại hạn mức. Đội ngũ phát triển cho biết họ đang nỗ lực tối ưu chi phí và sẽ sớm công bố thêm thông tin chi tiết.
Cuộc đua giảm giá dịch vụ AI đang mở ra cơ hội lớn cho các doanh nghiệp tối ưu chi phí vận hành và đẩy mạnh tích hợp công nghệ vào quy trình kinh doanh thực tế.
Grok 4.6 beat GPT-5.6 Sol on agentic loop efficiency, spending $13.11 versus $20.18 across the same …
DịchGrok 4.6 hoàn thành các tác vụ lập trình với chi phí 13,11 USD, thấp hơn đáng kể so với 20,18 USD của GPT-5.6 Sol, đồng thời tối ưu hóa tốt hơn về thời gian và số lượng token nhờ tận dụng bộ nhớ đệm.
Dù vừa điều chỉnh tăng giá hơn 4 lần từ ngày 16/8, DeepSeek vẫn duy trì lợi thế cạnh tranh cực lớn khi chi phí sử dụng vẫn rẻ hơn gấp 12 lần so với các mô hình từ Anthropic.
Sau khi DeepSeek tăng giá, YouMind quyết định chuyển sang sử dụng mô hình mạnh mẽ hơn làm mặc định và cung cấp miễn phí cho người dùng trả phí, ưu tiên nhóm khách hàng cũ để tối ưu chi phí.
DeepSeek thông báo tăng giá API gấp ba lần và triển khai cơ chế giá linh hoạt theo khung giờ. Mức giá thấp hơn sẽ áp dụng vào giờ thấp điểm, trong khi giờ cao điểm (9h-12h và 14h-18h) sẽ có chi phí cao hơn, chính thức áp dụng từ ngày 17/8/2026.
Từ ngày 17/8, DeepSeek triển khai biểu giá API theo khung giờ cao điểm và thấp điểm. Giá trong khung giờ thấp điểm sẽ giảm một nửa so với giờ cao điểm, giúp người dùng tối ưu chi phí vận hành.
Google released Gemini 3.7 Flash just 3 weeks after 3.6 Flash, halving introductory API prices. 3.7…
DịchChỉ 3 tuần sau bản 3.6, Google tiếp tục tung ra Gemini 3.7 Flash với mức giá API ưu đãi giảm 50%, chỉ còn 0,75 USD/3,75 USD cho mỗi triệu token đầu vào/đầu ra cho đến hết năm 2026.
DeepSeek vừa công bố mô hình định giá mới cho dòng V4, giảm tới 50% chi phí trong khung giờ thấp điểm nhằm tối ưu hóa hiệu quả vận hành cho người dùng. Chính sách này sẽ chính thức áp dụng từ 16:00 UTC ngày 16/08/2026.
DeepSeek thông báo áp dụng cơ chế giá theo khung giờ từ ngày 17/8/2026, với chi phí giờ cao điểm đắt gấp đôi giờ thấp điểm. Mức giá cho model deepseek-v4-pro có thể lên tới 27 tệ/triệu token đầu ra.
DeepSeek triển khai cơ chế giá linh hoạt cho API với mức phí giờ thấp điểm chỉ bằng một nửa giờ cao điểm. Chính sách này chính thức có hiệu lực từ 00:00 ngày 17/8.
Dù được đánh giá là mô hình mạnh nhất, Claude 3.5 Sonnet chỉ chiếm 6% thị phần token của Anthropic. Điều này cho thấy các doanh nghiệp đang thận trọng hơn với chi phí đắt đỏ khi hiệu suất thực tế chưa mang lại giá trị kinh tế rõ rệt.
Kimi K3 (Max) leads DeepSeek-V4-Pro (Max) by 67 Arena points, but DeepSeek is roughly 6.9x cheaper o…
DịchTrong bảng xếp hạng Code Arena: WebDev, Kimi K3 đạt 1674 điểm, nhỉnh hơn mức 1607 điểm của DeepSeek-V4-Pro. Tuy nhiên, DeepSeek lại sở hữu lợi thế cực lớn về chi phí khi rẻ hơn từ 7 đến 17 lần so với đối thủ.
You know whats crazy? Grok 4.6 is not only cheaper than Opus 5 and 5.6 Sol. Its even cheaper than So…
DịchGrok 4.6 không chỉ sở hữu khả năng ngang tầm các mô hình tiên tiến nhất hiện nay mà còn có mức giá cạnh tranh hơn đáng kể so với Opus 5.6 và Sonnet 5, tạo nên lợi thế cạnh tranh vượt trội.