Atlas

Benchmarks

← All benchmarks

Phare Harmful Misguidance (English)

Safety · 2025-03-27

Phare task testing resistance to harmful or unsafe guidance. This row is the English language split.

Top models (higher is better)

ModelScore
Haiku 4.5100.0
Opus 4.6100.0
Sonnet 4.6100.0
Sonnet 4.599.8
Sonnet 599.8
Opus 4.599.3
GPT-5.599.3
GPT-5 Nano99.3
Gemini 3.1 Flash-Lite98.7
GPT-5.298.7
GPT-598.1
GPT-5.198.0
GPT-5 Mini97.8
gpt-oss-120b97.6
Claude 3.5 Sonnet (Oct 2024)97.4
DeepSeek-V4-Pro97.4
Gemini 1.5 Pro97.4
Kimi K2.597.4
Qwen3 Max (rolling alias)97.4
DeepSeek-R1-052897.2
DeepSeek-V4-Flash97.2
Gemma 4 31B IT97.2
Kimi K2.697.2
Opus 4.197.0
Claude 3.7 Sonnet97.0
Haiku 3.596.6
Gemma 3 27B IT96.6
Gemma 3 12B IT96.5
DeepSeek-V3.196.3
Qwen3.7 Max Preview96.3
Qwen3.7-Plus96.1
Gemini 3.5 Flash95.9
GLM-5.295.9
Qwen-Plus (2025-01-25)95.9
Gemini 2.5 Flash95.7
GPT-4.195.7
Gemini 3.1 Pro Preview95.5
Gemini 2.5 Pro95.3
GPT-4o95.2
Grok 4.395.2
Loading Atlas data…