Atlas

Benchmarks

← All benchmarks

Legal Research Bench Weighted Pass Administrative/Regulatory

Professional Work · 2026-06-23

Weighted-pass practice-area score for Administrative/Regulatory tasks in Vals AI Legal Research Bench.

Top models (higher is better)

ModelScore
Claude Opus 592.7
Kimi K390.7
GPT-5.6 Sol90.7
Claude Fable 590.2
Grok 4.588.8
Sonnet 587.8
GPT-5.6 Luna87.5
Opus 4.887.4
Gemini 3.5 Flash87.1
Sonnet 4.686.8
GPT-5.6 Terra86.7
GPT-5.586.7
MiniMax M386.2
GLM-5.286.0
Inkling84.1
Qwen3.7-Max84.0
Muse Spark 1.183.6
Gemini 3.6 Flash83.5
DeepSeek-V4-Pro83.4
Inkling-Small83.0
GLM-5.180.0
Gemini 3.1 Pro Preview79.2
Kimi K2.675.5
Grok 4.373.9
Gemini 3.5 Flash-Lite72.0
GPT-5.4 Mini69.7
Laguna M.166.6
Laguna XS.258.1
Loading Atlas data…