Atlas

Benchmarks

← All benchmarks

FrontierFinance v3.1 — Comparative Analysis Rubrics

Professional Work · 2026-07-06

Comparative Analysis rubric-category slice in the official FrontierFinance v3.1 system breakdown, with a reported denominator of 264 rubric criteria. It reports micro-averaged rubric qualification rate within that displayed category.

Top models (higher is better)

ModelScore
GPT-5.6 Sol53.0
Opus 4.850.4
Claude Fable 550.2
GPT-5.545.6
GLM-5.245.5
Gemini 3.1 Pro Preview42.9
DeepSeek-V4-Pro39.8
Kimi K2.635.1
Loading Atlas data…