Atlas

Benchmarks

← All benchmarks

Legal Research Bench Weighted Pass

Professional Work · 2026-06-23

This row reports the practice-area score for Weighted Pass tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
Claude Opus 590.6
GPT-5.6 Sol87.8
Claude Fable 587.8
Kimi K387.0
Opus 4.886.1
Sonnet 4.685.3
GPT-5.6 Luna85.0
Muse Spark 1.184.6
Sonnet 584.6
Grok 4.584.4
GPT-5.6 Terra84.0
GPT-5.584.0
Gemini 3.5 Flash83.9
GLM-5.282.9
MiniMax M381.1
DeepSeek-V4-Pro80.7
Gemini 3.6 Flash80.5
Inkling80.2
Inkling-Small78.9
Qwen3.7-Max78.4
GLM-5.177.8
Gemini 3.1 Pro Preview76.6
Kimi K2.674.7
Grok 4.369.5
Gemini 3.5 Flash-Lite68.9
GPT-5.4 Mini67.3
Laguna M.162.3
Laguna XS.256.3
Loading Atlas data…