MEGA-Bench Task - FunQA Unexpected Action Humor Video: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1GPT-4o55.3
2Gemini 2.5 Pro (Preview 03-25)43.3
3GPT-4o Mini40.7
4Qwen 2 VL 72B40
5Gemini 1.5 Pro (002)39.3
6Gemini 1.5 Flash (002)39.3
7Claude 3.5 Sonnet (20240620)37.3
8Gemma 3 27B (IT)36.7
9InternVL3-8B35.3
10InternVL3-38B35.3
11InternVL3-78B32.7
12InternVL2.5-78B32.7
13Llama 4 Scout Base32
14Claude 3.5 Sonnet (20241022)28.7
15Pixtral-12B28.7

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-funqa-unexpected-action-humor-video · How It Works · Data refreshed daily, snapshot 2026-09-05.