MEGA-Bench Task - CVBench Adapted CVBench Depth — leaderboard

Metric: Task Score (%). Source: huggingface.co. 27 models tracked.

Top models

#ModelScore
1InternVL2.5-78B100
2Claude 3.5 Sonnet (20240620)100
3GPT-4o92.9
4InternVL2-8B85.7
5Claude 3.5 Sonnet (20241022)85.7
6Gemini 1.5 Pro (002)85.7
7Gemini 1.5 Flash (002)85.7
8Qwen 2 VL 72B78.6
9Pixtral-12B78.6
10GPT-4o Mini71.4
11InternVL2.5-2B64.3
12Qwen 2 VL 7B57.1
13Qwen 2 VL 2B57.1
14MiniCPM-V-2.657.1
15Aquila-VL-2B42.9

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-cvbench-adapted-cvbench-depth · How the rankings work · Data refreshed daily, snapshot 2026-07-22.