Atlas

Benchmarks

← All benchmarks

Legal Research Bench Criminal

Professional Work · 2026-06-23

This row reports the practice-area score for Criminal tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
Opus 4.845.6
Claude Opus 543.9
GPT-5.6 Sol43.9
Claude Fable 542.1
Sonnet 540.4
Sonnet 4.636.8
GPT-5.536.8
GPT-5.6 Terra36.8
Grok 4.536.8
Kimi K336.8
Muse Spark 1.136.8
GLM-5.129.8
GPT-5.6 Luna29.8
Gemini 3.5 Flash26.3
MiniMax M326.3
Gemini 3.6 Flash24.6
Inkling-Small24.6
GLM-5.222.8
Inkling21.1
Qwen3.7-Max21.1
Gemini 3.1 Pro Preview19.3
DeepSeek-V4-Pro15.8
Grok 4.314.0
Kimi K2.614.0
Gemini 3.5 Flash-Lite12.3
GPT-5.4 Mini5.3
Laguna M.10.0
Laguna XS.20.0
Loading Atlas data…