MEGA-Bench Task - Multilingual Movie Info Parsing: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro (Preview 03-25)77.6
2Claude 3.5 Sonnet (20240620)74.5
3Qwen 2 VL 72B69.4
4GPT-4o66.3
5InternVL3-78B66.3
6InternVL3-8B65.3
7Claude 3.5 Sonnet (20241022)65.3
8InternVL2.5-78B65.3
9Gemma 3 12B (IT)63.3
10InternVL3-38B63.3
11Qwen 2 VL 7B62.2
12Qwen 2 VL 2B62.2
13GPT-4o Mini60.2
14Gemma 3 27B (IT)57.1
15Gemma 3 4B (IT)57.1

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-multilingual-movie-info-parsing · How It Works · Data refreshed daily, snapshot 2026-09-05.