Atlas

Models

← All models

Llama 3.3 Nemotron Super 49B V1.5

NVIDIA · 2025-07-25 · 49.9B parameters

Llama 3.3 Nemotron Super 49B V1.5 is NVIDIA's upgraded open-weight reasoning and chat model derived from Meta's Llama 3.3 70B Instruct, released July 25, 2025; its BF16 checkpoint contains exactly 49,867,145,216 parameters. NAS and block-wise distillation produce a nonuniform 80-layer architecture whose 49 attention-bearing blocks use GQA while 31 skip attention; NVIDIA's launch post reports single-H100 deployment. It supports switchable reasoning, RAG, and tool calling with a 131,072-token context window.

Benchmark scores

BenchmarkScore
AA-LCR34.0
AA-Omniscience Index-45.6
AIME 202576.7
Artificial Analysis Intelligence Index12.4
Artificial Analysis Omniscience Accuracy16.9
Artificial Analysis Omniscience Hallucination Rate65.9
Artificial Analysis Openness Index52.8
BuseyBench SVG1.4
Capability135.3
CritPt0.0
Global MMLU Lite80.9
GPQA Diamond74.8
Humanity's Last Exam (Text-Only)6.8
IFBench (Artificial Analysis)37.0
LiveCodeBench (Artificial Analysis)73.7
MATH-500 (Artificial Analysis source)98.3
SciCode (Artificial Analysis)34.8
Snorkel Finance Reasoning35.4
SnorkelFinance44.0
SnorkelSequences66.8
Terminal-Bench Hard5.3
τ²-bench (Telecom)28.1
Loading Atlas data…