Atlas

Benchmarks

← All benchmarks

MGSM Bengali

Math · 2022-10-06

Bengali language split of the MGSM multilingual grade-school math benchmark.

Top models (higher is better)

ModelScore
Opus 4.596.8
Sonnet 4.594.8
GPT-5.294.8
GPT-594.8
GPT-5 Mini94.0
Opus 493.6
Opus 4.193.2
GPT-5.193.2
gpt-oss-120b92.8
O4 Mini92.8
Haiku 4.592.4
Llama 4 Maverick Instruct92.4
DeepSeek-V391.6
Sonnet 491.2
Qwen3 Max Preview91.2
Claude 3.5 Sonnet (Oct 2024)90.4
Claude 3.7 Sonnet90.4
DeepSeek-V3-032490.4
Gemini 1.5 Pro 00290.4
Gemini 3 Pro Preview90.4
GPT-4o (2024-11-20)90.4
o3-mini90.0
GLM-4.589.6
GPT-4o (2024-08-06)89.6
Qwen3 Max (rolling alias)89.6
Mistral Medium 389.2
Grok 3 Mini88.8
DeepSeek-R188.4
Qwen3-235B-A22B88.4
Llama 3.3 70B Instruct88.0
Grok 487.6
Grok 4.1 Fast87.6
Kimi K2 Instruct87.6
Mistral Large 2.1 (Instruct 2411)86.8
Grok 4 Fast86.4
Kimi K2 Thinking86.4
GPT-5 Nano86.0
o386.0
Gemini 1.5 Flash 00285.6
Command A84.4
Loading Atlas data…