Atlas

Benchmarks

← All benchmarks

Legal Research Bench Weighted Pass Family

Professional Work · 2026-06-23

Weighted-pass practice-area score for Family tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
Claude Opus 586.6
Kimi K379.3
GPT-5.6 Luna78.4
Claude Fable 577.9
Opus 4.877.3
Sonnet 4.676.8
GPT-5.6 Sol76.7
Gemini 3.5 Flash74.9
GPT-5.6 Terra74.2
Muse Spark 1.173.7
Sonnet 572.2
Inkling71.7
GPT-5.570.8
Grok 4.570.6
GLM-5.269.3
Inkling-Small68.9
MiniMax M368.0
DeepSeek-V4-Pro66.3
Kimi K2.661.0
Gemini 3.6 Flash59.6
Qwen3.7-Max59.3
Gemini 3.1 Pro Preview58.2
GLM-5.158.2
GPT-5.4 Mini51.6
Gemini 3.5 Flash-Lite49.7
Grok 4.347.3
Laguna M.142.0
Laguna XS.230.2
Loading Atlas data…