Atlas

Benchmarks

← All benchmarks

Artificial Analysis Intelligence Index v4.3

Indexes

Artificial Analysis Intelligence Index v4.3, combining AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench 4.0, SciCode, HLE, GDP.pdf, CritPt, AA-Omniscience and AA-LCR v1.1. Kept separate from earlier index compositions.

Top models (higher is better)

ModelScore
Claude Fable 5.153.4
GPT-6 Astra52.8
Claude Opus 550.7
Claude Fable 549.7
Muse Spark 1.348.2
GPT-5.6 Sol47.1
Qwen3.8 Max (0902)45.4
GLM-5.344.9
Grok 4.644.4
Kimi K343.8
GPT-5.6 Terra42.3
Opus 4.842.0
GLM-5.3 Flash41.9
Gemini 3.8 Flash41.2
Opus 4.740.7
Qwen3.8-Max40.3
Qwen3.8 2.4T A95B40.0
Qwen3.8-Flash-Next39.9
Muse Spark 1.239.8
Gemini 3.7 Flash39.6
DeepSeek V4.1 Flash39.5
Grok 4.539.1
GPT-5.439.0
GPT-5.538.6
Sonnet 538.4
GPT-5.6 Luna37.5
DeepSeek V4 Pro 081336.3
Agnes 3.0 Flash (hosted)35.5
Agnes 2.5 Pro Beta35.2
DeepSeek V4 Flash Vision Exp35.0
DeepSeek-V4-Flash-073134.5
Gemini 3.6 Flash34.3
Muse Spark 1.134.3
GLM-5.234.0
Qwen3.8 27B33.9
Gemini 3.5 Flash33.6
Motif 333.6
GPT-5.3-Codex32.5
Motif-3-Beta32.3
Opus 4.631.9
Loading Atlas data…