Atlas

Benchmarks

← All benchmarks

Legal Research Bench Weighted Pass Health

Professional Work · 2026-06-23

Weighted-pass practice-area score for Health tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
GPT-5.6 Sol97.5
Claude Opus 596.8
Claude Fable 594.5
GPT-5.6 Terra94.0
GPT-5.6 Luna93.8
GPT-5.593.6
Grok 4.593.2
Kimi K393.0
MiniMax M392.2
Sonnet 592.1
Gemini 3.5 Flash91.5
GLM-5.291.3
DeepSeek-V4-Pro91.2
Opus 4.890.8
Sonnet 4.690.3
Inkling88.5
Muse Spark 1.187.9
Gemini 3.6 Flash87.9
Qwen3.7-Max86.7
Inkling-Small84.4
Gemini 3.1 Pro Preview83.4
GLM-5.182.8
Kimi K2.681.7
Grok 4.381.2
Gemini 3.5 Flash-Lite75.7
GPT-5.4 Mini73.8
Laguna M.169.2
Laguna XS.262.8
Loading Atlas data…