Atlas

Benchmarks

← All benchmarks

MASK

Safety · 2025-03-05

Honesty score on prompts that pressure models to contradict their beliefs.

Top models (higher is better)

ModelScore
Opus 4.696.3
Muse Spark 1.196.2
Sonnet 4.596.1
Haiku 4.595.4
GPT-5.6 Sol95.4
Sonnet 495.3
Opus 4.194.2
Opus 4.594.1
GPT-5.6 Terra93.3
Claude Fable 592.8
GPT-5.6 Luna92.7
gpt-oss-120b92.0
Opus 4.891.9
GPT-5.4 Pro91.7
Kimi K390.6
GPT-5.490.3
GPT-5.590.1
Sonnet 4.688.3
GPT-5.188.0
Opus 487.9
GPT-5 Nano87.7
GPT-5.287.1
gpt-oss-20b86.5
GPT-5 Pro86.0
o384.5
GLM-5.184.2
GPT-5.4 Mini84.1
Claude 3.7 Sonnet83.1
Opus 4.782.9
GPT-5 Mini82.6
o3-pro82.5
Kimi K2.581.5
GPT-579.3
Opus 379.0
O4 Mini78.6
Kimi K2.676.8
GPT-5.4 Nano76.3
GLM-5.274.2
Claude 3.5 Sonnet (Oct 2024)72.3
Grok 4.572.1
Loading Atlas data…