Atlas

Models

← All models

Qwen3-Next-80B-A3B-Thinking

Alibaba · 2025-09-10 · 81.3B parameters

Qwen3-Next-80B-A3B-Thinking is Alibaba's thinking-only post-trained variant of the sparse Qwen3-Next-80B-A3B causal language model. It combines Gated DeltaNet with gated grouped-query attention and high-sparsity MoE layers; its native 262,144-token context can be extended with YaRN to 1,010,000 tokens.

Benchmark scores

BenchmarkScore
AA-LCR60.3
AA-Omniscience Index-50.6
AIME 202584.3
Arena Text — Business, Management & Financial Ops (No Style Control)1361
Arena Text — Chinese (No Style Control)1417
Arena Text — Creative Writing (No Style Control)1312
Arena Text — English (No Style Control)1393
Arena Text — Entertainment, Sports & Media (No Style Control)1313
Arena Text — Exclude Ties (No Style Control)1333
Arena Text — Exclude Ties (Style Controlled)1337
Arena Text — Expert (No Style Control)1367
Arena Text — French (No Style Control)1358
Arena Text — French (Style Controlled)1369
Arena Text — German (No Style Control)1359
Arena Text — Hard Prompts (No Style Control)1370
Arena Text — Hard Prompts English (No Style Control)1386
Arena Text — Instruction Following (No Style Control)1343
Arena Text — Japanese (No Style Control)1282
Arena Text — Korean (No Style Control)1308
Arena Text — Legal & Government (No Style Control)1365
Arena Text — Life, Physical & Social Science (No Style Control)1382
Arena Text — Longer Query (No Style Control)1352
Arena Text — Medicine & Healthcare (No Style Control)1391
Arena Text — Multi-turn (No Style Control)1346
Arena Text — Non-English (No Style Control)1339
Arena Text — Non-English (Style Controlled)1348
Arena Text — Occupational Mathematical (No Style Control)1389
Arena Text — Polish (No Style Control)1350
Arena Text — Polish (Style Controlled)1364
Arena Text — Russian (No Style Control)1338
Loading Atlas data…