MEGA-Bench Task - Image Humor Understanding: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro (Preview 03-25)91.7
2Claude 3.5 Sonnet (20241022)91
3Gemini 1.5 Flash (002)90.7
4Claude 3.5 Sonnet (20240620)89.3
5Gemini 1.5 Pro (002)89
6GPT-4o Mini87.6
7GPT-4o86.2
8Gemma 3 27B (IT)81
9Gemma 3 12B (IT)78.6
10Qwen 2 VL 72B77.9
11InternVL3-38B76.6
12InternVL3-78B75.5
13Pixtral-12B72.8
14InternVL2.5-78B71
15Gemma 3 4B (IT)69

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-image-humor-understanding · How It Works · Data refreshed daily, snapshot 2026-09-05.