Atlas

Benchmarks

← All benchmarks

LMArena Text Math No Style Control Elo

Math · 2024-09-09

Category-specific Elo score from the LMArena text-arena voting leaderboard. Higher Elo indicates stronger crowd-voted preference within this category.

Top models (higher is better)

ModelScore
Claude Opus 51564
Claude Fable 51529
Gemini 3.5 Flash1525
Gemini 3.6 Flash1523
Opus 4.61518
Opus 4.71498
Qwen3.7 Max Preview1494
GPT-5.41489
Gemini 3.1 Pro Preview1489
Opus 4.81485
GPT-5.51485
GLM-5.11479
ERNIE 5.11479
Muse Spark 1.11477
Gemini 3 Pro Preview1476
MiMo-V2.5-Pro1476
Grok 4.51475
Inkling1475
Kimi K2.61474
Gemini 3 Flash Preview1474
GLM-5.21471
Qwen3.7-Plus1470
Kimi K2.51469
Gemma 4 26B A4B1467
Gemma 4 31B1466
Sonnet 51464
Sonnet 4.61462
GPT-5.6 Sol1460
GPT-5.6 Terra1460
Opus 4.51459
GPT-5.6 Luna1454
GLM 5V Turbo1452
Muse Spark1451
Qwen3.6 Plus (2026-04-02)1451
Gemini 2.5 Pro1450
Qwen3 Max Preview1450
Qwen3.5 397B A17B1450
MiMo-V2-Pro1448
GPT-5.11443
DeepSeek-V4-Pro1443
Loading Atlas data…