Atlas

Benchmarks

← All benchmarks

Legal Research Bench Weighted Pass Criminal

Professional Work · 2026-06-23

Weighted-pass practice-area score for Criminal tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
Claude Opus 588.1
Opus 4.887.7
GPT-5.6 Sol86.4
Claude Fable 586.1
Sonnet 4.685.8
Muse Spark 1.185.4
Kimi K384.3
Sonnet 584.1
GPT-5.6 Terra83.4
Grok 4.582.6
Gemini 3.5 Flash82.4
GPT-5.6 Luna82.2
GPT-5.581.8
Gemini 3.6 Flash81.0
GLM-5.280.1
GLM-5.178.1
MiniMax M378.1
Inkling-Small78.0
Qwen3.7-Max77.7
Inkling77.4
DeepSeek-V4-Pro76.4
Gemini 3.1 Pro Preview76.2
Kimi K2.675.1
Grok 4.369.3
Gemini 3.5 Flash-Lite68.1
GPT-5.4 Mini64.4
Laguna M.161.6
Laguna XS.256.4
Loading Atlas data…