Atlas

Benchmarks

← All benchmarks

Code Migration

Code · 2026-06-16

Code-migration benchmark evaluating whether language models can reimplement real-world programs in a different programming language while preserving behavior.

Top models (higher is better)

ModelScore
Claude Opus 557.5
Claude Fable 555.1
GPT-5.6 Sol52.9
Opus 4.847.3
GPT-5.545.2
GPT-5.6 Luna44.5
Sonnet 544.4
Opus 4.743.9
Sonnet 4.639.9
GLM-5.237.9
Grok 4.536.6
GPT-5.6 Terra36.4
GPT-5.435.0
Muse Spark 1.131.1
Gemini 3.6 Flash30.9
Kimi K2.627.8
Gemini 3.5 Flash26.7
DeepSeek-V4-Pro26.2
GLM-5.125.8
Kimi K2.7 Code25.4
MiMo-V2.5-Pro21.6
MiniMax M319.9
Gemini 3.1 Pro Preview17.3
MiMo-V2.514.2
GPT-5.4 Mini12.9
Inkling11.8
Qwen3.6 Plus (2026-04-02)11.1
MiniMax M2.78.7
Haiku 4.57.6
Grok 4.36.8
Gemini 3 Flash Preview6.4
Gemini 3.5 Flash-Lite6.1
Gemini 3.1 Flash-Lite Preview4.6
Loading Atlas data…