Atlas

Benchmarks

← All benchmarks

SpatialViz-Bench

Multimodal · 2025-07-10

SpatialViz Bench evaluates spatial visualization capability in multimodal models. It asks models to reason over spatial arrangements and visual transformations.

Top models (higher is better)

ModelScore
GPT-5.6 Sol80.7
GPT-5.574.2
Kimi K2.673.9
Claude Fable 573.9
Gemini 3.5 Flash73.9
GPT-5.6 Luna71.3
Kimi K371.2
Muse Spark 1.170.3
GPT-5.469.3
Gemini 3.1 Pro Preview66.1
GPT-5.265.8
Gemini 3 Flash Preview65.3
Opus 4.865.2
GPT-5.6 Terra65.2
Gemini 3 Pro Preview63.2
Opus 4.762.6
Grok 4.561.1
GPT-5.4 Mini59.6
Opus 4.655.7
Sonnet 4.654.9
GPT-554.1
GPT-5 Mini52.5
GPT-5.151.3
Grok 4.349.6
o347.7
Gemini 2.5 Pro46.6
Grok 4.2045.6
Gemini 3.1 Flash-Lite Preview44.8
GPT-5.4 Nano44.6
Opus 4.543.0
Sonnet 4.541.6
O141.4
Grok 4.1 Fast38.5
Haiku 4.538.4
Gemini 2.5 Flash38.2
Grok 4 Fast36.8
GPT-5 Nano35.7
Gemini 2.5 Flash-Lite Preview 06-1735.2
Grok 434.8
Llama 4 Scout Instruct34.2
Loading Atlas data…