Atlas

Benchmarks

← All benchmarks

LLM Persuasion Average Strength

Chat & Writing · 2026-03-26

Measures how much a model persuader moves an opponent model toward its assigned side in multi-turn persuasion dialogues. Higher scores indicate stronger average persuasive effect.

Top models (higher is better)

ModelScore
GPT-5.41.7
Opus 4.61.7
Doubao Seed 2.0 Pro1.6
Sonnet 4.61.6
Kimi K2.51.3
Gemini 3.1 Pro Preview1.2
GLM-51.2
Grok 4.201.2
Qwen3.5 397B A17B1.0
MiniMax M2.71.0
Gemini 3.1 Flash-Lite Preview0.8
ERNIE 5.00.8
DeepSeek-V3.20.7
MiMo-V2-Pro0.5
Mistral Large 3 675B Instruct 25120.4
Loading Atlas data…