MEGA-Bench Task - FUNSD Document QA: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B92.9
2Qwen 2 VL 7B85.7
3Qwen 2 VL 2B85.7
4Claude 3.5 Sonnet (20240620)85.7
5GPT-4o78.6
6InternVL3-8B78.6
7Claude 3.5 Sonnet (20241022)78.6
8InternVL3-38B78.6
9InternVL2.5-78B78.6
10Gemini 2.5 Pro (Preview 03-25)78.6
11Gemma 3 27B (IT)71.4
12InternVL3-78B71.4
13InternVL2-8B71.4
14GPT-4o Mini71.4
15Gemma 3 12B (IT)64.3

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-funsd-document-qa · How It Works · Data refreshed daily, snapshot 2026-09-05.