ImageBench

vs

192 evaluations across 6 categories

Benchmark V1 verdicts are produced by VLM judges and can contain mistakes. Treat PASS/FAIL labels as machine-assisted assessments, and inspect the images yourself. Learn more about the methodology.

Generation Details

Source-backed model context, size, cost, and request settings for this ImageBench V1 run.

fal/qwen-image-2-pro

API

Qwen Image 2.0 Pro is Alibaba's Qwen (Tongyi Lab) flagship hosted text-to-image model, a top-10 model on the Artificial Analysis image arena known for best-in-class typography, infographics, and poster/layout rendering. Distinct from the older local Qwen-Image checkpoint on this board; released ~April 2026.

Maker
Alibaba (Qwen)
Family
Qwen Image 2.0
Model Size
not disclosed
unknown
Cost
$0.075 / image
high
Run Target
fal/fal-ai/qwen-image-2/pro/text-to-image
Effective Request
image_size: square_hd · seed: 7

xai/grok-imagine-2

API

Grok Imagine Image 2.0 is xAI's text-to-image model (released Aug 2026), emphasizing photorealism, natural lighting, physics, and textures. Served via xAI's first-party API (OpenAI-images-compatible). The first xAI model on this board.

Maker
xAI
Family
Grok Imagine 2.0
Model Size
not disclosed
unknown
Cost
$0.04 / image
high
Run Target
xai/grok-imagine-image-2.0
Effective Request
aspect_ratio: 1:1 · resolution: 1k
66.9vs73.6
Overall
71%vs76%
Capability
63.1vs71.6
Est. Preference
12.8svs69.0s
Avg Latency
Text Rendering100%100%Spatial Reasoning75%90%Human realism38%38%Truthfulness59%56%Professional Studio93%100%Graphical design88%88%Preference63%72%Latency25%0%

All 192 generations

Text Rendering100%vs100%

fal/qwen-image-2.0-proxai/grok-imagine-2.0

Typography Style100%vs100%

Writing accuracy100%vs100%

Spatial Reasoning75%vs89%

fal/qwen-image-2.0-proxai/grok-imagine-2.0

Attributes Binding89%vs100%

Compositionality89%vs100%

Counting67%vs100%

Negation89%vs100%

Relative Position83%vs75%

Scale & Proportions33%vs67%

Human realism38%vs38%

fal/qwen-image-2.0-proxai/grok-imagine-2.0

Faces & Expressions92%vs83%

Full Body17%vs8%

Hands0%vs17%

Multi-Subject50%vs50%

Truthfulness59%vs56%

fal/qwen-image-2.0-proxai/grok-imagine-2.0

Photorealism33%vs100%

Physics & Reflections50%vs42%

World Knowledge75%vs58%

Professional Studio93%vs100%

fal/qwen-image-2.0-proxai/grok-imagine-2.0

Camera & Lighting83%vs100%

Color Precision100%vs100%

Photorealism100%vs100%

Graphical design88%vs88%

fal/qwen-image-2.0-proxai/grok-imagine-2.0

Data Visualisation67%vs67%

Layout & Design78%vs100%

Style Diversity100%vs83%