MEGA-Bench Task - Table Understanding Complex Question Answering: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o78.6
2Gemini 2.5 Pro (Preview 03-25)71.4
3Claude 3.5 Sonnet (20240620)71.4
4Claude 3.5 Sonnet (20241022)57.1
5Qwen 2 VL 72B50
6Llama 4 Scout Base50
7Qwen 2 VL 7B42.9
8Gemini 1.5 Pro (002)42.9
9Gemma 3 27B (IT)35.7
10Gemma 3 12B (IT)35.7
11InternVL3-78B35.7
12InternVL3-38B35.7
13GPT-4o Mini35.7
14Pixtral-12B35.7
15InternVL3-8B28.6

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-table-understanding-complex-question-answering · How It Works · Data refreshed daily, snapshot 2026-09-05.