Atlas

Benchmarks

← All benchmarks

Roboflow Vision Evals - OCR

Multimodal · 2026-07-22

The Roboflow Vision Evals OCR task measures mean transcription similarity to ground truth across 37 image samples.

Top models (higher is better)

ModelScore
Claude Fable 594.0
Opus 4.893.8
Kimi K393.0
Gemini 3.1 Pro Preview92.6
Muse Spark 1.192.5
Sonnet 591.7
GPT-5.591.2
Gemini 3.5 Flash91.1
GPT-5.6 Sol90.7
GLM 5V Turbo89.3
Gemini 2.5 Pro88.8
GPT-5.6 Terra88.8
Kimi K2.688.5
Gemini 3.6 Flash88.4
GPT-5.6 Luna88.4
Qwen3-VL-235B-A22B-Instruct88.1
GPT-5.4 Mini88.1
Gemini 3 Flash Preview87.6
Gemini 3.5 Flash-Lite87.4
Qwen3.7-Plus86.5
Qwen3.5-27B84.5
Loading Atlas data…