Atlas

Benchmarks

← All benchmarks

SlopCodeBench - Verbosity Mean

Code · 2026-01-20

Mean code verbosity, scaled to percent; lower is better.

Top models (lower is better)

ModelScore
MiniMax M2.726.5
GPT-5.526.9
GPT-5.427.3
Opus 4.529.7
Kimi K2.530.9
Sonnet 4.631.6
Opus 4.631.8
GLM-5.132.2
GPT-5.4 Mini33.0
GPT-5.3-Codex33.6
Composer 235.3
Opus 4.735.7
GPT-5.3-Codex-Spark35.7
GPT-5.2-Codex39.8
Kimi K2.639.9
Loading Atlas data…