MEGA-Bench Task - Table Understanding FeTaQA — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)77.9
2Claude 3.5 Sonnet (20240620)70.7
3GPT-4o67.9
4Ovis2-8B65
5Gemini 2.5 Pro63.6
6Qwen 2 VL 72B62.9
7InternVL2.5-78B61.4
8Qwen 2 VL 7B60.7
9InternVL3-38B60.7
10GPT-4o Mini60
11Gemini 2.0 Flash (Preview)59.3
12Gemma 3 27B (IT)58.6
13InternVL3-8B58.6
14Gemma 3 4B (IT)53.6
15Gemini 1.5 Pro (002)52.9

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-table-understanding-fetaqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.