MEGA-Bench Task - Game Info Parsing: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Qwen 2 VL 72B94.8
2Claude 3.5 Sonnet (20241022)94.8
3Gemini 2.5 Pro (Preview 03-25)94.8
4Claude 3.5 Sonnet (20240620)94.2
5InternVL3-78B92.9
6InternVL3-38B91.6
7InternVL2.5-78B91.6
8InternVL3-8B90.9
9Gemma 3 27B (IT)89.6
10GPT-4o87.7
11Qwen 2 VL 7B87.7
12Llama 4 Scout Base87
13Gemma 3 12B (IT)85.7
14GPT-4o Mini85.1
15Gemini 1.5 Pro (002)82.5

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-game-info-parsing · How It Works · Data refreshed daily, snapshot 2026-09-05.