Atlas

Benchmarks

← All benchmarks

LMArena Text Arena Math Elo

Math · 2024-07-30

Category-specific Elo score from the LMArena text-arena voting leaderboard. Higher Elo indicates stronger crowd-voted preference within this category.

Top models (higher is better)

ModelScore
Claude Opus 51553
Claude Fable 51534
Gemini 3.6 Flash1521
Gemini 3.5 Flash1521
Opus 4.61518
Opus 4.71504
GPT-5.51499
GPT-5.41493
Opus 4.81493
Gemini 3.1 Pro Preview1492
Qwen3.7 Max Preview1490
Muse Spark 1.11488
Grok 4.51488
GPT-5.6 Sol1485
GLM-5.11483
Kimi K2.61479
Gemini 3 Pro Preview1478
ERNIE 5.11477
GPT-5.6 Luna1476
GPT-5.6 Terra1476
Gemini 3 Flash Preview1476
Inkling1476
MiMo-V2.5-Pro1475
GLM-5.21475
Gemma 4 31B1471
Sonnet 51471
Kimi K2.51470
Qwen3.7-Plus1470
Gemma 4 26B A4B1468
Opus 4.51465
Sonnet 4.61464
Muse Spark1462
GPT-5.21458
GPT-5.11455
Qwen3.6 Plus (2026-04-02)1455
MiMo-V2-Pro1452
GLM 5V Turbo1449
Qwen3.5 397B A17B1447
O3 (2025-04-16)1447
DeepSeek-V4-Pro1445
Loading Atlas data…