Atlas

Benchmarks

← All benchmarks

CadQueryEval — Volume

Code · 2026-01-10

Percentage of CadQueryEval tasks whose generated mesh volume is within 2% of the reference geometry.

Top models (higher is better)

ModelScore
GPT-5.6 Sol Pro96.0
Gemini 3.1 Pro Preview88.0
GPT-5.6 Luna88.0
GPT-5.6 Luna Pro88.0
GPT-5.6 Terra Pro88.0
GPT-5.6 Sol84.0
Kimi K384.0
Gemini 3.5 Flash80.0
Qwen3.7-Max80.0
Claude Fable 576.0
Opus 4.872.0
Sonnet 572.0
GPT-5.572.0
Grok 4.372.0
Grok 4.572.0
Opus 4.668.0
GPT-5.6 Terra68.0
GLM-5.164.0
Muse Spark 1.164.0
Opus 4.760.0
Gemini 3 Pro Preview60.0
Kimi K2.660.0
Qwen3.7-Plus60.0
Gemini 3 Flash Preview56.0
GLM-5.256.0
GPT-5 Mini56.0
Hy3 preview56.0
MiniMax M356.0
Opus 4.552.0
Sonnet 4.552.0
Kimi K2.552.0
Qwen3.6 Plus (2026-04-02)52.0
Sonnet 4.648.0
Gemini 3.1 Flash-Lite48.0
Opus 4.144.0
DeepSeek-V4-Flash44.0
GPT-544.0
GPT-5.144.0
GPT-5.244.0
GPT-5.444.0
Loading Atlas data…