MEGA-Bench Task - Multilingual Movie Info Parsing — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro77.6
2Claude 3.5 Sonnet (20240620)74.5
3Gemini 2.0 Flash (Preview)73.5
4Qwen 2 VL 72B69.4
5GPT-4o66.3
6InternVL3-78B66.3
7InternVL3-14B66.3
8InternVL3-8B65.3
9Claude 3.5 Sonnet (20241022)65.3
10InternVL2.5-78B65.3
11Gemma 3 12B (IT)63.3
12InternVL3-38B63.3
13Qwen 2 VL 7B62.2
14Qwen 2 VL 2B62.2
15GPT-4o Mini60.2

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-multilingual-movie-info-parsing · How the rankings work · Data refreshed daily, snapshot 2026-07-22.