Atlas

Benchmarks

← All benchmarks

LMArena Text Arena Instruction Following Elo

Chat & Writing · 2024-07-30

Category-specific Elo score from the LMArena text-arena voting leaderboard. Higher Elo indicates stronger crowd-voted preference within this category.

Top models (higher is better)

ModelScore
Claude Fable 51515
Opus 4.61514
Opus 4.71503
Claude Opus 51498
Opus 4.81494
GPT-5.6 Sol1481
Gemini 3.1 Pro Preview1481
Kimi K31480
GPT-5.51479
Sonnet 4.61477
Gemini 3.6 Flash1477
Muse Spark 1.11475
GPT-5.41475
Opus 4.51474
Gemini 3 Pro Preview1474
MiMo-V2.5-Pro1469
Qwen3.7 Max Preview1466
GLM-5.11464
Gemini 3.5 Flash1464
GLM-5.21464
GPT-5.6 Terra1464
Muse Spark1463
Grok 4.51463
Sonnet 4.51463
Sonnet 51463
Gemini 3 Flash Preview1458
Opus 4.11455
DeepSeek-V4-Pro1455
Kimi K2.61454
ERNIE 5.11452
Gemma 4 31B1452
Qwen3.7-Plus1451
GPT-5.11448
GPT-5.6 Luna1448
Hy31447
GLM-51447
MiMo-V2-Pro1445
Gemma 4 26B A4B1441
MiniMax M31439
Gemini 2.5 Pro1439
Loading Atlas data…