Atlas

Benchmarks

← All benchmarks

FrontierSWE (Dominance)

Code · 2026-04-16

FrontierSWE is an ultra-long-horizon software-engineering benchmark scored by model performance on difficult repository-level tasks.

Top models (higher is better)

ModelScore
Claude Fable 586.6
Kimi K381.2
GPT-5.6 Sol71.3
GLM-5.267.3
Opus 4.866.7
GPT-5.564.9
Loading Atlas data…