Atlas

Benchmarks

← All benchmarks

Phare Prompt Injection (French)

Safety · 2025-12-09

Phare jailbreak task testing resistance to prompt-injection attacks. This row is the French language split.

Top models (higher is better)

ModelScore
Haiku 4.598.8
Opus 4.197.5
Sonnet 4.596.7
Opus 4.596.2
Haiku 3.594.7
Opus 4.692.7
Sonnet 4.692.7
Sonnet 589.7
GPT-5.287.4
Kimi K2.686.0
Qwen3.7 Max Preview85.7
Qwen3.7-Plus85.7
Claude 3.7 Sonnet85.2
GPT-5.583.4
GPT-5 Nano83.2
Kimi K2.583.0
GPT-5 Mini82.3
GPT-5.181.7
gpt-oss-120b81.5
GPT-578.1
Grok 477.9
GPT-4.1 Nano74.2
Llama 3.1 405B Instruct73.9
DeepSeek-V4-Pro72.4
GLM-5.271.7
Grok 4.370.4
DeepSeek-V4-Flash69.4
GPT-4o69.4
GPT-4.166.4
Gemma 4 31B IT65.9
GPT-4o Mini64.7
Gemini 3.1 Pro Preview63.9
Llama 4 Maverick63.7
Qwen2.5-Max63.2
Qwen-Plus (2025-01-25)61.1
Gemini 3 Pro Preview60.4
Qwen3 Max (rolling alias)59.4
Grok 4 Fast57.9
DeepSeek-R1-052855.4
DeepSeek-V3.154.4
Loading Atlas data…