Atlas

Models

← All models

Llama 3.3 Nemotron Super 49B V1.5

NVIDIA · 2025-07-25 · 49.9B parameters

Llama 3.3 Nemotron Super 49B V1.5 is NVIDIA's upgraded open-weight reasoning and chat model derived from Meta's Llama 3.3 70B Instruct, released July 25, 2025; its BF16 checkpoint contains exactly 49,867,145,216 parameters. NAS and block-wise distillation produce a nonuniform 80-layer architecture whose 49 attention-bearing blocks use GQA while 31 skip attention; NVIDIA's launch post reports single-H100 deployment. It supports switchable reasoning, RAG, and tool calling with a 131,072-token context window.

Benchmark scores

BenchmarkScore
AA-LCR34.0
AA-Omniscience Index-45.6
AIME 2025 (Artificial Analysis avg@10)76.7
Artificial Analysis Intelligence Index12.4
Artificial Analysis Omniscience Accuracy16.9
Artificial Analysis Omniscience Hallucination Rate65.9
Artificial Analysis Openness Index52.8
BuseyBench SVG1.4
Capability135.3
CritPt (avg@5)0.0
Global MMLU Lite80.9
GPQA Diamond (Artificial Analysis avg@5)74.8
Humanity's Last Exam (Text-Only)6.8
IFBench (Artificial Analysis)37.0
LiveCodeBench (Artificial Analysis)73.7
MATH-500 (Artificial Analysis source)98.3
SciCode (Artificial Analysis avg@3)34.8
Snorkel Finance Reasoning35.4
SnorkelFinance44.0
SnorkelSequences66.8
Terminal-Bench Hard5.3
τ²-bench (Telecom)28.1
Loading Atlas data…