Atlas

Benchmarks

← All benchmarks

Legal Research Bench Health

Professional Work · 2026-06-23

This row reports the practice-area score for Health tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
GPT-5.6 Sol80.0
Claude Opus 576.7
GPT-5.6 Terra76.7
GPT-5.6 Luna70.0
Claude Fable 566.7
GPT-5.566.7
Grok 4.566.7
Sonnet 563.3
Kimi K363.3
Opus 4.853.3
Sonnet 4.653.3
GLM-5.250.0
DeepSeek-V4-Pro46.7
MiniMax M346.7
Gemini 3.5 Flash43.3
Inkling43.3
Grok 4.340.0
Muse Spark 1.140.0
Qwen3.7-Max40.0
Gemini 3.6 Flash36.7
GLM-5.136.7
Gemini 3.1 Pro Preview33.3
Inkling-Small30.0
Kimi K2.630.0
GPT-5.4 Mini16.7
Gemini 3.5 Flash-Lite13.3
Laguna M.13.3
Laguna XS.20.0
Loading Atlas data…