Atlas

Benchmarks

← All benchmarks

Legal Research Bench

Professional Work · 2026-06-23

Vals AI Legal Research Bench evaluates legal research performance on private tasks spanning multiple practice areas.

Top models (higher is better)

ModelScore
Claude Opus 555.3
Claude Fable 549.5
GPT-5.6 Sol48.1
Kimi K344.2
Opus 4.843.8
Sonnet 541.8
GPT-5.6 Terra40.9
GPT-5.540.4
Sonnet 4.638.5
Grok 4.538.0
Muse Spark 1.138.0
GPT-5.6 Luna36.5
GLM-5.231.3
Gemini 3.5 Flash30.8
MiniMax M329.8
Inkling28.4
GLM-5.127.9
Inkling-Small25.5
Qwen3.7-Max25.5
Gemini 3.6 Flash25.0
DeepSeek-V4-Pro23.1
Gemini 3.1 Pro Preview20.7
Kimi K2.615.9
Grok 4.315.4
Gemini 3.5 Flash-Lite13.9
GPT-5.4 Mini12.5
Laguna M.12.4
Laguna XS.21.0
Loading Atlas data…