Atlas

Benchmarks

← All benchmarks

SlopCodeBench - Erosion Mean

Code · 2026-01-20

Mean code-quality erosion, scaled to percent; lower is better.

Top models (lower is better)

ModelScore
GPT-5.549.4
MiniMax M2.750.0
GPT-5.450.8
GLM-5.155.0
GPT-5.3-Codex-Spark58.6
GPT-5.3-Codex64.4
GPT-5.4 Mini65.5
Opus 4.569.1
Kimi K2.569.2
Composer 271.6
GPT-5.2-Codex72.8
Opus 4.673.7
Sonnet 4.674.1
Opus 4.775.9
Kimi K2.676.4
Loading Atlas data…