Atlas

Benchmarks

← All benchmarks

IOI - IOI 2024

Code · 2025-08-11

The IOI 2024 split of IOI. This child benchmark separates a source-reported subtask or subtrack from the parent aggregate so scores at different grains do not share one benchmark_slug.

Top models (higher is better)

ModelScore
Claude Fable 5100.0
Claude Opus 5100.0
GPT-5.6 Sol85.0
GPT-5.6 Luna78.0
GPT-5.467.2
GPT-5.6 Terra66.2
GPT-5.3-Codex58.2
Opus 4.753.2
GPT-5.243.8
Gemini 3 Flash Preview41.0
Qwen3.7-Max40.5
Gemini 3 Pro Preview38.5
DeepSeek-V4-Pro31.3
Gemini 3.5 Flash-Lite25.0
GLM-523.7
Grok 423.2
Grok 4.2022.5
Qwen3 Max (rolling alias)21.5
Opus 4.520.7
Sonnet 4.519.0
Gemini 2.5 Pro19.0
Opus 4.118.7
GPT-5.1-Codex-Max14.5
GPT-5.4 Nano14.2
DeepSeek-V3.214.0
Grok 4.313.0
Qwen3 Max Thinking (2026-01-23)12.3
Kimi K2.512.2
GPT-5.111.8
Qwen3 Max Preview11.7
GPT-511.0
GLM-4.710.5
Sonnet 49.7
Grok 4 Fast9.3
Grok 4.1 Fast7.7
O4 Mini7.7
MiniMax M2.57.5
GPT-5.4 Mini6.7
Haiku 4.56.5
GPT-5 Mini6.5
Loading Atlas data…