Atlas

Benchmarks

← All benchmarks

Phare Prompt Injection

Safety · 2025-12-09

Phare jailbreak task testing resistance to prompt-injection attacks.

Top models (higher is better)

ModelScore
Haiku 4.598.1
Opus 4.197.8
Sonnet 4.597.4
Opus 4.597.0
Opus 4.695.3
Haiku 3.593.4
Sonnet 593.3
Sonnet 4.692.4
GPT-5.289.0
GPT-5.588.7
Qwen3.7 Max Preview88.2
Kimi K2.687.6
GPT-5 Mini86.5
Claude 3.7 Sonnet86.3
GPT-5 Nano86.2
Qwen3.7-Plus86.1
gpt-oss-120b86.0
Kimi K2.585.2
GPT-5.185.2
GPT-581.3
Llama 3.1 405B Instruct79.1
Grok 477.2
GPT-4.1 Nano75.8
GLM-5.275.7
Grok 4.375.2
Gemma 4 31B IT71.2
GPT-4o71.2
GPT-4.170.0
Gemini 3.1 Pro Preview69.1
Qwen-Plus (2025-01-25)68.9
Llama 4 Maverick68.3
Gemini 3 Pro Preview68.0
GPT-4o Mini67.3
Qwen2.5-Max66.7
DeepSeek-V4-Flash66.0
DeepSeek-V4-Pro64.7
Qwen3 Max (rolling alias)64.4
GPT-4.1 Mini61.3
Gemini 3.1 Flash-Lite60.3
Grok 4 Fast60.3
Loading Atlas data…