Thủ thuật
So sánh chi phí, chất lượng và khả năng chỉnh sửa của 20 mô hình tạo ảnh trên OpenRouter
(giờ Việt Nam)
Tóm tắt AI
OpenRouter đã thử nghiệm 20 mô hình tạo ảnh với cùng một câu lệnh, cho thấy sự chênh lệch chi phí lên tới 22 lần, dao động từ 0,006 USD đến 0,134 USD mỗi ảnh.
Bản dịch AI

Chúng tôi định tuyến 52 mô hình tạo ảnh thông qua một API duy nhất. Chúng tôi đã chạy cùng một câu lệnh (prompt) trên 20 mô hình trong số đó và ghi lại chi phí của mỗi lần gọi, kết quả trả về và các tham số mà chúng chấp nhận.
Chi phí là phần khó nhất, bởi vì các mô hình này không được bán theo cùng một đơn vị. FLUX.2 được tính giá theo megapixel. Gemini, OpenAI và Microsoft MAI được tính giá theo token. Grok, Recraft, Riverflow, Qwen và Seedream được tính giá theo mỗi ảnh, với mức giá thay đổi tùy thuộc vào chất lượng và độ phân giải mà bạn yêu cầu. Trang thông tin của mỗi mô hình đều hiển thị đúng đơn vị tính của nó, vì vậy bạn không thể so sánh hai mô hình bằng cách đọc giá của chúng đặt cạnh nhau.
Chúng tôi đã đưa chúng về cùng một hệ quy chiếu. 20 mô hình mà chúng tôi thử nghiệm đều nhận được cùng một câu lệnh với cùng kích thước, và chúng tôi đọc trường usage.cost từ mỗi phản hồi, đây chính là số tiền chúng tôi bị tính phí.
Mọi mức giá trên trang này đều đến từ một lần tạo ảnh thực tế, được đo lường vào ngày 11 tháng 9 năm 2026. Giá cả và các mô hình thay đổi thường xuyên, vì vậy hãy coi bất kỳ con số nào cũ hơn một tháng chỉ là thông tin tham khảo thay vì một hạn mức ngân sách cố định. Bạn có thể truy xuất trạng thái hiện tại bằng lệnh GET /api/v1/images/models để xem các tham số được chấp nhận và GET /api/v1/images/models/{model}/endpoints để xem giá với đơn vị tính cụ thể.
Tóm tắt
Chi phí mà mỗi mô hình đã tính cho chúng tôi
Chúng tôi đã gửi cho mỗi mô hình trong số 20 mô hình này câu lệnh “A studio packshot of a glass bottle, hard key light, no text.” với aspect_ratio: "1:1" và không có cài đặt nào khác, sau đó đọc giá trị usage.cost từ phản hồi. Cột đơn vị tính (billing unit) là trường đơn vị từ hồ sơ giá của mỗi endpoint.
Hình 1. Các mức giá tương đương, đã được sắp xếp. Ba đơn vị tính phí đan xen nhau trên toàn bộ dải giá, vì vậy đơn vị tính không cho bạn biết vị thế của một mô hình trong bảng xếp hạng.
Ba điều cần biết trước khi bạn lập ngân sách từ bảng này.
Cài đặt chất lượng làm thay đổi giá tới 35 lần
Trên các mô hình của OpenAI, chất lượng làm thay đổi hóa đơn của bạn nhiều hơn bất kỳ cài đặt nào khác. Chúng tôi đã chạy gpt-image-2 với cùng một câu lệnh ở cùng kích thước 1024x1024 với chất lượng không thiết lập, thiết lập ở mức thấp (low) và thiết lập ở mức cao (high).
Việc để trống cài đặt chất lượng cho kết quả số lượng token và hóa đơn tương đương với mức thấp. Hãy thiết lập chất lượng một cách rõ ràng khi hình ảnh quan trọng, và coi mức giá trên mỗi ảnh của mô hình OpenAI là chưa đầy đủ trừ khi nó nêu rõ cấp độ chất lượng. Lần gọi ở mức cao cũng mất 123 giây để trả về kết quả so với 12 giây cho lần gọi mặc định.
Tỷ lệ khung hình (aspect ratio) làm thay đổi hóa đơn ít hơn nhiều
Trên một mô hình tính giá theo megapixel, khung hình bạn yêu cầu sẽ làm thay đổi hóa đơn, nhưng ít hơn so với số lượng pixel gợi ý. Chúng tôi đã chạy black-forest-labs/flux.2-klein-4b ở hai hình dạng. Lần gọi 21:9 trả về 2400x1024, tương đương 2,46 megapixel so với 1,05 megapixel cho khung hình vuông. Chúng tôi bị tính phí 0,014 đô la cho khung hình vuông và 0,016 đô la cho khung hình rộng.
Mức giá niêm yết và chi phí thực tế có thể khác nhau
Mỗi mô hình công bố một mức giá trên trang của nó và trên route endpoints của API. Những mức giá đó là con số kế hoạch, còn phản hồi mới là số tiền bạn phải trả. Vào ngày 11 tháng 9 năm 2026, sourceful/riverflow-v2.5-pro niêm yết 0,13 đô la mỗi ảnh ở độ phân giải mặc định nhưng tính phí chúng tôi 0,064 đô la. black-forest-labs/flux.2-flex niêm yết 0,06 đô la mỗi megapixel và tính phí chúng tôi 0,05 đô la cho một ảnh một megapixel. black-forest-labs/flux.2-max niêm yết 0,07 đô la và tính phí chúng tôi chính xác 0,07 đô la. krea/krea-2-medium không công bố hồ sơ giá trên endpoint của nó và tính phí chúng tôi 0,03 đô la.
Khi hai con số này không khớp, hãy đọc giá trị usage.cost thay vì nhân mức giá niêm yết với ước tính.
Chúng tôi tính phí đầy đủ cho một yêu cầu tạo ảnh hoàn tất và không tính phí cho yêu cầu thất bại. Tài liệu thanh toán của Image API mô tả những kết quả nào sẽ bị tính phí.
Tham chiếu, định dạng và giới hạn
Giá là một trục. Đây là các trục khác, và hai trong số đó loại bỏ các mô hình trước khi chi phí trở nên quan trọng. Các giá trị đến từ trường supported_parameters của mỗi endpoint vào ngày 11 tháng 9 năm 2026.
Ảnh tham chiếu (reference image) là ảnh bạn gửi kèm theo yêu cầu để mô hình làm việc dựa trên đó, có thể là ảnh bạn muốn chỉnh sửa hoặc ví dụ về phong cách hoặc sản phẩm bạn muốn khớp. Giới hạn về số lượng ảnh bạn có thể gửi là một rào cản cứng. Grok nhận ba ảnh và Gemini nhận mười bốn ảnh, vì vậy một bộ nhận diện thương hiệu gồm sáu ảnh sẽ loại Grok ra trước khi bạn so sánh bất cứ điều gì khác.
Cột phương thức đầu ra (output modalities) là trục thứ hai. Hầu hết các mô hình này nhận đầu vào là văn bản và hình ảnh nhưng chỉ trả về dữ liệu ảnh. Các mô hình ảnh Gemini và các mô hình gpt-5-image của OpenAI cũng có thể trả về văn bản viết trong cùng một phản hồi, điều này quan trọng nếu bạn muốn mô hình giải thích những gì nó đã tạo ra. Chúng tôi đã kiểm tra độ tin cậy của chúng trong việc thực hiện điều đó ở phần dưới.
Hãy truy xuất lại bảng này cho bất kỳ mô hình nào bằng lệnh GET /api/v1/images/models, lệnh này công bố các tham số được chấp nhận và phạm vi của chúng cho mỗi mô hình. Một tham số vắng mặt trong supported_parameters nghĩa là không được hỗ trợ trên endpoint đó.
Seed đã tái tạo hình ảnh chính xác trên FLUX.2 Klein
seed là con số bạn gửi để làm cho kết quả có thể lặp lại. Nó thiếu trong mọi mô hình ảnh Gemini, Grok, OpenAI, Riverflow, Recraft và MAI trong danh mục của chúng tôi. Nó tồn tại trên FLUX.2, Seedream, Qwen và Krea.
Chúng tôi đã chạy black-forest-labs/flux.2-klein-4b hai lần với cùng một câu lệnh và seed: 424242. Hai phản hồi giống hệt nhau từng byte một, và cả hai đều bị tính phí 0,014 đô la. Chúng tôi chỉ thử nghiệm Klein, vì vậy hãy coi các mô hình có khả năng sử dụng seed khác là chưa được kiểm chứng thay vì giả định chúng hoạt động theo cùng một cách. Để so sánh, hai lần gọi sourceful/riverflow-v2.5-fast không có tham số seed đã trả về hai hình ảnh khác nhau từ cùng một nội dung yêu cầu.
Các bảng xếp hạng nói gì
Chúng tôi hiển thị xếp hạng Design Arena trên trang của mỗi mô hình. Khi chúng tôi truy xuất xếp hạng hiện tại thông qua API điểm chuẩn vào ngày 11 tháng 9 năm 2026, sourceful/riverflow-v2.5-pro có xếp hạng cao nhất trên cả bảng xếp hạng ảnh và bảng xếp hạng chỉnh sửa ảnh. Các mô hình MAI Image 2.6 của Microsoft và các mô hình ảnh Gemini của Google theo sau trên bảng xếp hạng ảnh, và black-forest-labs/flux.2-klein-4b có xếp hạng thấp nhất trong số các mô hình được liệt kê trên cả hai bảng.
Những xếp hạng đó đến từ các cuộc bỏ phiếu đối đầu giữa các mô hình, mà Design Arena chuyển đổi thành xếp hạng Elo, một điểm số tăng lên khi một mô hình thắng một trận đấu và giảm xuống khi nó thua.
Hai lưu ý. Xếp hạng của Gemini nằm trên các phiên bản -preview của các slug đó thay vì các slug phát hành chung mà chúng tôi liên kết trên trang này. Và Elo cho bạn biết những gì người bỏ phiếu ưa thích trên câu lệnh của họ, không phải của bạn. Mô hình được xếp hạng cao nhất tính phí 0,064 đô la mỗi ảnh trong thử nghiệm của chúng tôi và mô hình được xếp hạng thấp nhất tính phí 0,014 đô la. Hãy lập danh sách rút gọn từ bảng, sau đó quyết định dựa trên câu lệnh của riêng bạn.
Chúng tôi đã chạy một câu lệnh qua sáu mô hình
Chúng tôi đã gửi một câu lệnh cho sáu mô hình trên khắp các dải giá và đặt hóa đơn bên dưới mỗi hình ảnh. Chúng tôi yêu cầu một túi cà phê màu đen nhám với hai dòng chữ được in trên đó.
Câu lệnh
A studio packshot of a matte black coffee bag on a plain white background, hard key light. Printed across the front of the bag in clean sans-serif capitals are the words OPENROUTER ROASTERS, and beneath that in smaller capitals the words SINGLE ORIGIN.
Chúng tôi chọn những từ dễ đọc vì chúng dễ chấm điểm. Hoặc là cái túi ghi đúng những gì bạn yêu cầu hoặc là không.
Hình 2. Cùng một câu lệnh qua sáu mô hình, với chi phí đo lường của mỗi lần gọi.
Năm trong số sáu mô hình đã in đúng cả hai dòng. Ngoại lệ là black-forest-labs/flux.2-klein-4b, mô hình này hiển thị đúng tên thương hiệu nhưng viết sai dòng thứ hai thành SINGLE ORISION.
Sự so sánh hữu ích nhất là giữa mô hình rẻ nhất và mô hình đắt nhất trên bảng Design Arena. openai/gpt-image-2 tính phí 0,0135 đô la và sourceful/riverflow-v2.5-pro tính phí 0,0654 đô la, và cả hai đều tạo ra một hình ảnh sản phẩm đúng, có thể sử dụng được. Chi tiêu gấp khoảng năm lần mang lại cho chúng tôi một vẻ ngoài khác biệt, chứ không phải văn bản tốt hơn.
Điều đó không làm cho Riverflow trở nên đắt đỏ. Nó dẫn đầu các bảng xếp hạng Design Arena, và trên một hình ảnh khó hơn, một bố cục bất thường hoặc một chuỗi văn bản dài hơn, khoảng cách có thể sẽ lộ rõ. Điều đó có nghĩa là cả bảng xếp hạng lẫn cột giá đều không dự đoán được kết quả trên câu lệnh này, và chỉ có việc thực sự chạy câu lệnh mới làm được điều đó.
Bài viết được AI dịch và tổng hợp tự động từ OpenRouter: Announcements. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.