MEGA-Bench Task - Game Info Parsing — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro94.8
2Qwen 2 VL 72B94.8
3Claude 3.5 Sonnet (20241022)94.8
4Claude 3.5 Sonnet (20240620)94.2
5InternVL3-78B92.9
6Gemini 2.0 Flash (Preview)92.9
7InternVL3-38B91.6
8InternVL2.5-78B91.6
9InternVL3-8B90.9
10InternVL3-14B90.3
11Gemma 3 27B (IT)89.6
12GPT-4o87.7
13Qwen 2 VL 7B87.7
14Ovis2-8B87
15Llama 4 Scout Base87

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-game-info-parsing · How the rankings work · Data refreshed daily, snapshot 2026-07-22.