Atlas

Benchmarks

← All benchmarks

CadQueryEval — Watertight Mesh

Code · 2026-01-10

Percentage of CadQueryEval tasks whose generated mesh is manifold and watertight after mesh cleaning.

Top models (higher is better)

ModelScore
Gemini 3.1 Pro Preview92.0
GPT-5.6 Sol92.0
GPT-5.6 Sol Pro92.0
GPT-5.6 Luna84.0
GPT-5.6 Luna Pro84.0
GPT-5.6 Terra Pro84.0
Opus 4.880.0
GPT-5.580.0
GPT-5.6 Terra80.0
Grok 4.580.0
Kimi K380.0
Qwen3.7-Max80.0
Claude Fable 576.0
Sonnet 576.0
Opus 4.672.0
Grok 4.372.0
MiniMax M372.0
Gemini 3.5 Flash68.0
Gemini 3 Pro Preview68.0
Muse Spark 1.168.0
Opus 4.564.0
Opus 4.764.0
DeepSeek-V4-Pro64.0
GLM-5.164.0
GPT-5 Mini64.0
Kimi K2.664.0
Qwen3.7-Plus64.0
Sonnet 4.660.0
Gemini 3 Flash Preview60.0
GPT-560.0
Hy3 preview60.0
GLM-5.256.0
GPT-5.156.0
GPT-5.256.0
GPT-5.456.0
Kimi K2.556.0
Claude 3.5 Sonnet (Oct 2024)52.0
Gemini 3.1 Flash-Lite52.0
O4 Mini52.0
Claude 3.7 Sonnet48.0
Loading Atlas data…