MEGA-Bench Task - CVBench Adapted CVBench Relation — leaderboard

Metric: Task Score (%). Source: huggingface.co. 27 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)71.4
2Claude 3.5 Sonnet (20240620)71.4
3GPT-4o64.3
4Qwen 2 VL 72B64.3
5Pixtral-12B64.3
6InternVL2.5-78B64.3
7InternVL2-8B57.1
8Qwen 2 VL 7B57.1
9Gemini 1.5 Pro (002)50
10Gemini 1.5 Flash (002)42.9
11MiniCPM-V-2.635.7
12GPT-4o Mini35.7
13Aquila-VL-2B28.6
14Qwen 2 VL 2B14.3
15InternVL2.5-2B14.3

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-cvbench-adapted-cvbench-relation · How the rankings work · Data refreshed daily, snapshot 2026-07-22.