MEGA-Bench Task - Table Understanding FeTaQA: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)77.9
2Claude 3.5 Sonnet (20240620)70.7
3GPT-4o67.9
4Gemini 2.5 Pro (Preview 03-25)63.6
5Qwen 2 VL 72B62.9
6InternVL2.5-78B61.4
7Qwen 2 VL 7B60.7
8InternVL3-38B60.7
9GPT-4o Mini60
10Gemma 3 27B (IT)58.6
11InternVL3-8B58.6
12Gemma 3 4B (IT)53.6
13Gemini 1.5 Pro (002)52.9
14InternVL3-78B47.9
15Gemini 1.5 Flash (002)47.9

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-table-understanding-fetaqa · How It Works · Data refreshed daily, snapshot 2026-09-05.