MEGA-Bench Task - Art Explanation — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro87.6
2Claude 3.5 Sonnet (20241022)83.8
3Claude 3.5 Sonnet (20240620)75.2
4Gemma 3 27B (IT)72.8
5Gemini 1.5 Flash (002)70.7
6GPT-4o Mini69.3
7InternVL3-78B68.6
8Gemini 1.5 Pro (002)66.6
9Gemma 3 12B (IT)65.2
10InternVL3-38B62.4
11Qwen 2 VL 72B62.1
12GPT-4o61.7
13Llama 4 Scout Base60
14Ovis2-8B58.3
15Gemma 3 4B (IT)57.6

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-art-explanation · How the rankings work · Data refreshed daily, snapshot 2026-07-22.