MEGA-Bench Task - Table Understanding Complex Question Answering — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o78.6
2Gemini 2.5 Pro71.4
3Claude 3.5 Sonnet (20240620)71.4
4Claude 3.5 Sonnet (20241022)57.1
5Gemini 2.0 Flash (Preview)57.1
6Qwen 2 VL 72B50
7Llama 4 Scout Base50
8Qwen 2 VL 7B42.9
9InternVL3-14B42.9
10MiniCPM-V-2.642.9
11Gemini 1.5 Pro (002)42.9
12Gemma 3 27B (IT)35.7
13Gemma 3 12B (IT)35.7
14InternVL3-78B35.7
15InternVL3-38B35.7

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-table-understanding-complex-question-answering · How the rankings work · Data refreshed daily, snapshot 2026-07-22.