Atlas

Benchmarks

← All benchmarks

IOI - IOI 2025

Code · 2025-08-11

The IOI 2025 split of IOI. This child benchmark separates a source-reported subtask or subtrack from the parent aggregate so scores at different grains do not share one benchmark_slug.

Top models (higher is better)

ModelScore
GPT-5.6 Sol88.3
Claude Opus 583.3
GPT-5.468.5
GPT-5.6 Luna67.8
GPT-5.265.8
GPT-5.6 Terra64.3
Qwen3.7-Max53.0
Claude Fable 544.5
Opus 4.741.0
DeepSeek-V4-Pro40.3
Gemini 3 Pro Preview39.2
Grok 4.2037.8
Gemini 3 Flash Preview37.2
GPT-5.131.2
GPT-5.3-Codex29.5
Grok 429.2
GPT-529.0
GPT-5.1-Codex-Max28.3
Gemini 3.5 Flash-Lite27.3
Opus 4.526.5
Kimi K2.523.2
GLM-520.3
Sonnet 4.517.7
Grok 4.317.7
GPT-5-Codex16.7
GPT-5.4 Nano16.3
Gemini 2.5 Pro15.2
Qwen3 Max Thinking (2026-01-23)15.2
DeepSeek-V3.214.8
Grok 4 Fast13.7
Qwen3 Max (rolling alias)9.8
MiniMax M2.79.3
GLM 4.67.7
Grok 4.1 Fast7.7
GPT-5.1-Codex7.3
GPT-5 Mini7.0
Opus 4.16.4
GPT-5.4 Mini6.2
Haiku 4.55.8
MiniMax M2.55.8
Loading Atlas data…