Skip to content
Model Pareto

Image generation models ranked by quality, price and speed

BenchmarkText-to-imageImage editing

Quality vs price

5 models on the frontier — nothing else is both cheaper and better.

Lower price is better. Pareto frontier: Z-Image Turbo, Muse Image, MAI-Image-2.6-Flash, MAI-Image-2.6, GPT Image 2.5 Sunburst. 1 models are not plotted: Qwen-Image-2.1.

1 model with no price data — shown in the strip at the left edge

Qwen-Image-2.1

  • Best-value frontier (nothing is both cheaper and better)
  • Evidencestrong → weak
  • Estimated from other categories

Ranking · 38 models

Price $/image · Speed s/image

Image generation ranking. Column headers sort the table. Expand a row to see per-benchmark scores.
Select to compareSourceDetails
199.5±1.9$0.21108s4/6 benchmarks measuredVerified
291.7±3.2$0.2156s4/6 benchmarks measuredVerified
382.6±3.2$0.21118s4/6 benchmarks measuredVerified
475.3±3.2$0.039est.~17s4/6 benchmarks measuredVerified
570.7±3.2$0.060est.~13s4/6 benchmarks measuredVerified
665.7±4.3$0.019est.~9.5s2/6 benchmarks measuredVerified
7
Muse ImageFrontier
63.8±3.2$0.01014s4/6 benchmarks measuredVerified
861.8±4.3$0.11est.~37s2/6 benchmarks measuredVerified
961.8±3.2$0.0678.9s4/6 benchmarks measuredVerified
1060.9±3.2$0.04828s4/6 benchmarks measuredVerified
1158.0±3.2$0.09068s4/6 benchmarks measuredVerified
1258.0±3.2$0.1317s4/6 benchmarks measuredVerified
1357.0±3.2$0.1328s4/6 benchmarks measuredVerified
1454.3±3.5$0.04011s3/6 benchmarks measuredVerified
1551.9±3.5$0.0505.4s3/6 benchmarks measuredVerified
1650.6±4.3——3/6 benchmarks measuredVerified
1749.5±8.2$0.10est.~24s1/6 benchmarks measuredVerified
1848.1±4.3$0.0306.2s2/6 benchmarks measuredVerified
1947.9±3.2$0.0343.1s4/6 benchmarks measuredVerified
2042.1±8.2$0.040est.~14s1/6 benchmarks measuredVerified
2141.0±3.2$0.10est.~29s4/6 benchmarks measuredVerified
2236.9±4.3$0.10est.~29s2/6 benchmarks measuredVerified
2334.7±3.2$0.035est.~15s4/6 benchmarks measuredVerified
2434.6±3.2$0.04011s4/6 benchmarks measuredVerified
2530.3±3.2$0.07030s4/6 benchmarks measuredVerified
2630.0±4.3$0.06034s2/6 benchmarks measuredVerified
2729.6±4.7$0.060est.~11s2/6 benchmarks measuredVerified
2829.6±3.2$0.060est.~23s4/6 benchmarks measuredVerified
2929.6±5.6$0.030est.~11s1/6 benchmarks measuredVerified
3028.5±3.2$0.03012s4/6 benchmarks measuredVerified
3128.0±5.6$0.035est.~13s1/6 benchmarks measuredVerified
3227.0±4.7$0.21est.~53s2/6 benchmarks measuredVerified
3326.5±3.2$0.01216s4/6 benchmarks measuredVerified
3424.1±3.3$0.0407.3s5/6 benchmarks measuredMixed
3520.0±3.2$0.0154.0s4/6 benchmarks measuredVerified
36
Z-Image TurboFrontierOpen
17.7±3.9$0.0051.9s4/6 benchmarks measuredMixed
3714.2±4.0$0.02021s4/6 benchmarks measuredMixed
3810.5±3.2$0.011est.~6.3s4/6 benchmarks measuredVerified

About image generation

Text-to-image, image editing, and text rendering. Quality is a weighted average of the benchmarks below, each rescaled so 100 = the best tracked model. Benchmarks without a published score are estimated from related ones (shown dashed). Dot fill shows the evidence: solid = strong, tinted = medium, empty ring = weak (few benchmarks measured, lab-reported only or provisional). Methodology

Day-0 (model cards) Third-party

Top quality
GPT Image 2.5 Sunburst
99.5 / 100
Cheapest on the frontier
Z-Image Turbo
17.7 quality · $0.005
Newest
Ming-Image-0.1-Design
Sep 22, 2026
Fully verified
92%
of 38 models