Atlas

Benchmarks

← All benchmarks

Code Migration — Code Quality

Code · 2026-06-16

Code-quality rubric score (0–5) sub-track of the Code Migration benchmark. Split out because it is a 0–5 rubric, not a 0–100 pass rate.

Top models (higher is better)

ModelScore
Sonnet 54.9
Claude Opus 54.8
Opus 4.84.7
Opus 4.74.6
Claude Fable 54.4
Grok 4.54.1
Sonnet 4.64.0
GLM-5.24.0
GPT-5.6 Sol3.8
MiniMax M33.7
GPT-5.43.6
Kimi K2.7 Code3.5
GLM-5.13.5
Qwen3.6 Plus (2026-04-02)3.5
GPT-5.53.5
DeepSeek-V4-Pro3.4
MiMo-V2.5-Pro3.4
Haiku 4.53.3
GPT-5.6 Terra3.3
Gemini 3.6 Flash3.3
GPT-5.6 Luna3.2
Kimi K2.63.1
Grok 4.33.1
GPT-5.4 Mini3.1
MiniMax M2.73.0
Muse Spark 1.12.8
Gemini 3.5 Flash2.8
MiMo-V2.52.8
Gemini 3.1 Flash-Lite Preview2.7
Gemini 3 Flash Preview2.7
Gemini 3.5 Flash-Lite2.7
Gemini 3.1 Pro Preview2.5
Inkling2.2
Loading Atlas data…