Atlas

Benchmarks

← All benchmarks

Phare Prompt Injection (English)

Safety · 2025-12-09

Phare jailbreak task testing resistance to prompt-injection attacks. This row is the English language split.

Top models (higher is better)

ModelScore
Haiku 4.597.9
Opus 4.197.9
Opus 4.597.3
Sonnet 4.597.3
Opus 4.697.3
Sonnet 596.8
Haiku 3.593.6
GPT-5.593.5
gpt-oss-120b92.5
GPT-5.292.4
Sonnet 4.691.9
GPT-5 Nano90.4
Kimi K2.690.4
GPT-5 Mini90.2
GPT-5.189.8
Kimi K2.589.8
Qwen3.7 Max Preview88.1
Claude 3.7 Sonnet87.7
Qwen3.7-Plus87.6
GPT-586.0
GLM-5.283.0
GPT-4.1 Nano82.9
GPT-4.179.7
Qwen-Plus (2025-01-25)79.2
Grok 479.1
Llama 3.1 405B Instruct78.6
Grok 4.378.1
Qwen2.5-Max77.5
Gemini 3 Pro Preview77.0
Gemma 4 31B IT76.5
Gemini 3.1 Pro Preview75.9
GPT-4o75.4
GPT-4o Mini73.3
Qwen3 Max (rolling alias)72.5
Gemini 3.1 Flash-Lite70.0
GPT-4.1 Mini69.3
Qwen3 VL 30B A3B Instruct63.6
Grok 4 Fast63.1
Gemini 3.5 Flash62.0
Llama 4 Maverick61.5
Loading Atlas data…