MEGA-Bench Task - ActivityNetQA — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o70.5
2Qwen 2 VL 72B58.9
3Aquila-VL-2B51.6
4Gemini 1.5 Flash (002)50.5
5InternVL2.5-78B49.5
6InternVL3-14B48.4
7Qwen 2 VL 2B47.9
8Gemma 3 27B (IT)45.8
9InternVL3-78B45.8
10InternVL2.5-2B45.3
11Gemini 1.5 Pro (002)44.7
12Gemini 2.0 Flash (Preview)44.7
13Qwen 2 VL 7B44.5
14InternVL2-8B43.2
15InternVL3-38B41.6

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-activitynetqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.