Atlas

Models

← All models

Llama 3.1 Nemotron Ultra 253B V1

NVIDIA · 2025-04-07 · 253.4B parameters

Llama 3.1 Nemotron Ultra 253B V1 is NVIDIA's open-weight, dense decoder-only reasoning model derived from Meta's Llama 3.1 405B Instruct through NAS, attention removal, variable FFNs, and FFN fusion; the released checkpoint contains exactly 253,401,268,224 parameters. Released on April 7, 2025, it accepts and emits text, supports a 131,072-token context, and uses a system prompt to switch between reasoning and non-reasoning modes for chat, RAG, tool calling, and agentic workloads.

Benchmark scores

BenchmarkScore
AA-LCR7.3
AA-Omniscience Index-45.5
AIME 2025 (Artificial Analysis avg@10)63.7
Arena Text — Business, Management & Financial Ops (No Style Control)1301
Arena Text — Creative Writing (No Style Control)1315
Arena Text — English (No Style Control)1345
Arena Text — Entertainment, Sports & Media (No Style Control)1277
Arena Text — Exclude Ties (No Style Control)1264
Arena Text — Exclude Ties (Style Controlled)1304
Arena Text — Hard Prompts (No Style Control)1316
Arena Text — Hard Prompts English (No Style Control)1336
Arena Text — Instruction Following (No Style Control)1308
Arena Text — Life, Physical & Social Science (No Style Control)1324
Arena Text — Longer Query (No Style Control)1299
Arena Text — Multi-turn (No Style Control)1317
Arena Text — Non-English (No Style Control)1283
Arena Text — Non-English (Style Controlled)1306
Arena Text — Russian (No Style Control)1283
Arena Text — Software & IT Services (No Style Control)1327
Arena Text — Writing, Literature & Language (No Style Control)1300
Artificial Analysis Intelligence Index9.1
Artificial Analysis Omniscience Accuracy19.9
Artificial Analysis Omniscience Hallucination Rate81.7
Artificial Analysis Openness Index52.8
BFCL v4 Overall Accuracy10.0
Capability133.3
CritPt (avg@5)0.0
Design Arena Overall Code Categories959
EQ-Bench 31043
EQ-Bench 3 (Rubric Score)46.4
Loading Atlas data…