Atlas

Benchmarks

← All benchmarks

Harvey HLAB - Criteria Pass Rate - Banking Finance

Professional Work · 2026-05-06

The Banking Finance practice-area split of Harvey's Legal Agent Benchmark held-out evaluation criteria pass rate. This reports pooled rubric criteria passed within that split and is distinct from the all-pass task-score split.

Top models (higher is better)

ModelScore
Grok 4.595.5
Muse Spark 1.194.8
Claude Fable 592.6
Kimi K392.2
Sonnet 4.691.5
Sonnet 590.0
Opus 4.887.7
GPT-5.6 Luna86.6
MiniMax M386.6
Claude Opus 586.2
DeepSeek-V4-Pro86.2
GPT-5.586.2
Gemini 3.6 Flash85.9
GLM-5.285.9
Qwen3.7-Max85.9
Kimi K2.684.8
GPT-5.6 Terra83.6
GPT-5.6 Sol81.4
Gemini 3.5 Flash80.7
GPT-5.480.3
Gemini 3.5 Flash-Lite79.9
Inkling72.1
GLM-5.171.0
Laguna M.169.5
Grok 4.367.3
Qwen3.7-Plus64.3
Laguna XS.253.6
Loading Atlas data…