MEGA-Bench Task - OCRQA — leaderboard

Metric: Task Score (%). Source: huggingface.co. 27 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)89.3
2Claude 3.5 Sonnet (20240620)88.3
3GPT-4o86.9
4Qwen 2 VL 72B82.1
5InternVL2.5-78B81.7
6Gemini 1.5 Pro (002)81
7GPT-4o Mini78.3
8Pixtral-12B78.3
9Gemini 1.5 Flash (002)77.6
10Qwen 2 VL 7B69.3
11InternVL2-8B61.4
12MiniCPM-V-2.661.4
13Qwen 2 VL 2B56.9
14InternVL2.5-2B41.4
15Aquila-VL-2B34.8

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-ocrqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.