Atlas

Benchmarks

← All benchmarks

Phare Prompt Injection (Spanish)

Safety · 2025-12-09

Phare jailbreak task testing resistance to prompt-injection attacks. This row is the Spanish language split.

Top models (higher is better)

ModelScore
Sonnet 4.598.2
Opus 4.197.9
Haiku 4.597.6
Opus 4.597.6
Opus 4.696.1
Sonnet 593.4
Sonnet 4.692.7
Haiku 3.591.9
Qwen3.7 Max Preview90.6
GPT-5.589.0
GPT-5.287.3
GPT-5 Mini87.2
Kimi K2.686.5
Claude 3.7 Sonnet86.1
GPT-5 Nano84.9
Qwen3.7-Plus84.9
Llama 3.1 405B Instruct84.6
GPT-5.184.0
gpt-oss-120b84.0
Kimi K2.582.8
GPT-579.8
Llama 4 Maverick79.8
Grok 4.377.1
Grok 474.4
DeepSeek-V4-Flash72.6
GLM-5.272.3
DeepSeek-V4-Pro71.4
Gemma 4 31B IT71.3
GPT-4.1 Nano70.5
GPT-4o68.7
Gemini 3.1 Pro Preview67.5
Gemini 3 Pro Preview66.6
Qwen-Plus (2025-01-25)66.3
Llama 4 Scout64.5
GPT-4.163.9
GPT-4o Mini63.9
Qwen3 Max (rolling alias)61.5
DeepSeek-R1-052860.2
Gemini 3.1 Flash-Lite60.2
GPT-4.1 Mini60.2
Loading Atlas data…