Tomer Tunguz Blog (phân tích VC)
85

Thủ thuật

Nghịch lý Jevons trong kỷ nguyên AI: Chiến lược định giá phân tầng và bài toán cung cầu tính toán

(giờ Việt Nam)

Tóm tắt AI

Trong khi các ông lớn công nghệ vẫn chật vật với cơn khát chip, chiến lược định giá AI đang phân hóa mạnh mẽ: Anthropic tăng giá gấp đôi cho dòng model cao cấp, trong khi OpenAI lại giảm sâu tới 80% cho các phiên bản mới.

Bản dịch AI

Racing to Sustain Jevons' Paradox

Tóm lại: Các nhà cung cấp dịch vụ đám mây quy mô lớn (Hyperscalers) tuyên bố AI đang bị hạn chế về năng lực trong các báo cáo tài chính quý 2 năm 2026. Bộ nhớ HBM3e tăng 20% và HBM4 được dự báo sẽ tăng gấp đôi, trong khi giá thuê GPU B200 trên thị trường giao ngay vẫn đi ngang. Các nhà phát triển mô hình đang phân khúc thị trường thành các tầng cao cấp (premium), tầm trung (mid-market) và giá trị (value) để duy trì nghịch lý Jevons trước cú sốc sắp tới.

Nguồn cung AI hiện không đủ đáp ứng. Nghịch lý Jevons đã trở thành dấu ấn của kỷ nguyên này, giống như Định luật Moore đối với chip. Liệu nó có sớm thất bại?

Chúng tôi vẫn tiếp tục bị hạn chế về nguồn cung, một dấu hiệu của đà tăng trưởng và sự chấp nhận nhanh chóng. — Sundar Pichai, Alphabet quý 2 năm 2026.1

Chúng tôi vẫn sẽ không có đủ năng lực để đáp ứng tất cả nhu cầu trong năm 2026, và tôi tin rằng tình trạng này cũng sẽ tiếp diễn vào năm 2027. Nhu cầu mà chúng tôi đã ghi nhận cho năm 2028 thực sự rất đáng kinh ngạc. — Andy Jassy, Amazon quý 2 năm 2026.2

Doanh số Blackwell đang vượt xa mọi dự báo, và các GPU đám mây đều đã cháy hàng. — Jensen Huang, NVIDIA quý 1 năm tài chính 2027.3

Vậy điều gì sẽ xảy ra nếu giá AI tăng gấp đôi?

Giá đã bắt đầu tăng. Anthropic ra mắt Fable 5 vào ngày 24 tháng 7 với mức giá 50 USD cho mỗi triệu token đầu ra, gấp đôi Opus 5 và thiết lập một ngưỡng trần mới cho các mô hình tiên phong. Dòng sản phẩm chủ lực Gemini của Google đã tăng từ 1,50 USD lên 12 USD qua bốn thế hệ.4

OpenAI, Anthropic, & Google flagship output token prices, March 2023 – July 2026, with the July 30 Sol-Luna divergence

Hoặc ít nhất là hầu hết đều đang tăng. OpenAI đã cắt giảm 80% giá của GPT-5.6 Luna chỉ năm ngày sau khi Fable 5 ra mắt, đây có thể là một động thái chiếm lĩnh thị trường hoặc một bước đột phá về chi phí cơ bản.5

Lập luận từ trước đến nay về AI là: Nghịch lý Jevons thúc đẩy tiêu dùng nhiều hơn khi giá giảm. Nhưng hiện tại, giá đang tăng.

Các phòng thí nghiệm AI đang đặt cược vào việc phân khúc thị trường. Chừng nào các tầng giá trị và tầm trung còn hấp thụ được khối lượng công việc bị loại khỏi phân khúc cao cấp do giá cả, thì tổng số giờ GPU tiêu thụ vẫn sẽ tiếp tục tăng. Phân khúc thị trường giúp duy trì nghịch lý Jevons.

Frontier models cost 13× more for 20% more intelligence: premium, mid-market, & value tiers

Tầng cao cấp có chi phí gấp 13 lần tầng giá trị nhưng chỉ mang lại thêm một phần năm (20%) trí tuệ. Phân khúc tầm trung là nhân tố mới xuất hiện: GPT-5.6 Sol và Kimi K3, cung cấp 96% trí tuệ của các mô hình tiên phong với chỉ 40% chi phí.67 Phân khúc giá trị trải dài từ GLM-5.2 đến DeepSeek V4 Flash, cung cấp 84% trí tuệ với mức giá chỉ bằng 1 đến 5% so với tầng cao cấp.

Khi phân khúc thị trường trở thành tiêu chuẩn, các bộ định tuyến (routers) sẽ trở thành lớp chiến lược giữa người mua và mô hình, là hệ thống dẫn đường cho phép ứng dụng chuyển truy vấn đến đúng mô hình cần thiết. Các bộ định tuyến sẽ nằm bên trong các mô hình, bên ngoài phần mềm của khách hàng và trong các bộ công cụ hỗ trợ.

Mỗi phòng thí nghiệm lớn đều cần có sản phẩm ở cả ba tầng, nếu không họ sẽ thua trong cuộc đấu giá định tuyến dựa trên giá cả. Các startup giành chiến thắng bằng cách sở hữu một điểm duy nhất trên thị trường tiên phong mà các phòng thí nghiệm lớn không thể cạnh tranh về mặt kinh tế. DeepSeek V4 Flash với giá 0,03 USD là minh chứng cho điều này.

Tất cả đều nhằm thúc đẩy nghịch lý Jevons.

Báo cáo thu nhập quý 2 năm 2026 của Alphabet, phát biểu của Sundar Pichai, ngày 22 tháng 7 năm 2026. ↩︎

Andy Jassy cho biết Amazon sẽ chi 220 tỷ USD trong năm nay nhưng vẫn không đủ năng lực để đáp ứng nhu cầu, Fortune, ngày 30 tháng 7 năm 2026. ↩︎

Báo cáo thu nhập quý 1 năm tài chính 2027 của NVIDIA: doanh thu, EPS và triển vọng, ngày 20 tháng 5 năm 2026. ↩︎

Lạm phát mô hình AI. Các nhà cung cấp đang chuyển dịch từ chiến lược trợ giá để chiếm thị phần sang chiến lược định giá để tối ưu biên lợi nhuận khi chi phí vốn (capex) đạt mức kỷ lục. ↩︎

Giá GPT-5.6 có hiệu lực từ ngày 30 tháng 7 năm 2026: Sol ở mức 5 USD/30 USD, Luna ở mức 0,20 USD/1,20 USD cho mỗi triệu token. Thông báo về hiệu suất giá của OpenAI GPT-5.6; VentureBeat: OpenAI cắt giảm 80% giá GPT-5.6 Luna. ↩︎

Chỉ số Trí tuệ Nhân tạo Artificial Analysis v4.1 truy cập ngày 04/08/2026. ↩︎

Trí tuệ trung bình của phân khúc tầm trung (GPT-5.6 Sol & Kimi K3 là 58) so với trung bình phân khúc cao cấp (Opus 5 & Fable 5 là 60,5) = 96%. Tỷ lệ chi phí 1,05 USD / 2,75 USD = 38%. ↩︎

Nhận bài viết tiếp theo trong hộp thư đến của bạn.

Bài đọc 1 phút giúp biến dữ liệu công nghệ thành lợi thế chiến lược. Được đọc bởi hơn 150.000 nhà sáng lập và nhà điều hành.

Đối tác quản lý (GP) tại Theory Ventures. Cựu Giám đốc sản phẩm (PM) tại Google. Chia sẻ những hiểu biết dựa trên dữ liệu về AI, web3 và đầu tư mạo hiểm.

Bloomberg • WSJ • Economist

AIKinh tế AITính toánChiến lược giáOpenAI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Tomer Tunguz Blog (phân tích VC). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.