MEGA-Bench Task - ActivityNetQA: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o70.5
2Qwen 2 VL 72B58.9
3Aquila-VL-2B51.6
4Gemini 1.5 Flash (002)50.5
5InternVL2.5-78B49.5
6Qwen 2 VL 2B47.9
7Gemma 3 27B (IT)45.8
8InternVL3-78B45.8
9InternVL2.5-2B45.3
10Gemini 1.5 Pro (002)44.7
11Qwen 2 VL 7B44.5
12InternVL2-8B43.2
13InternVL3-38B41.6
14GPT-4o Mini41.6
15InternVL3-8B41.1

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-activitynetqa · How It Works · Data refreshed daily, snapshot 2026-09-05.