Atlas

Benchmarks

← All benchmarks

Phare Harmful Misguidance (French)

Safety · 2025-03-27

Phare task testing resistance to harmful or unsafe guidance. This row is the French language split.

Top models (higher is better)

ModelScore
Opus 4.6100.0
Sonnet 4.6100.0
Haiku 4.599.8
Sonnet 4.599.2
Sonnet 599.2
GPT-5 Mini99.0
Opus 4.598.7
GPT-5.598.7
GPT-5.197.5
Kimi K2.597.5
Kimi K2.697.0
Gemini 1.5 Pro97.0
GPT-5 Nano96.6
GPT-596.4
Gemini 2.0 Flash96.2
Gemini 3.1 Flash-Lite96.0
Gemini 3.5 Flash96.0
GPT-5.296.0
Gemma 4 31B IT95.6
Opus 4.195.4
DeepSeek-V3.194.9
Qwen3.7 Max Preview94.9
Haiku 3.594.7
DeepSeek-R1-052894.7
DeepSeek-V4-Pro94.7
Gemini 3.1 Pro Preview94.7
DeepSeek-V4-Flash94.3
Qwen3.7-Plus94.3
Qwen3 Max (rolling alias)94.1
Claude 3.7 Sonnet94.1
Claude 3.5 Sonnet (Oct 2024)93.7
Gemma 3 12B IT93.7
Qwen-Plus (2025-01-25)92.8
Llama 4 Maverick92.6
Mistral Medium 3.192.6
Gemini 3 Pro Preview92.4
gpt-oss-120b92.4
GLM-5.292.2
Grok 4.392.2
DeepSeek-V3-032491.9
Loading Atlas data…