MEGA-Bench Task - Visual Prediction Rater Novel View Synthesis — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro42.9
2Gemini 2.0 Flash (Preview)28.6
3Aquila-VL-2B21.4
4Qwen 2 VL 2B14.3
5Gemini 1.5 Pro (002)14.3
6Llama 4 Scout Base14.3
7GPT-4o7.1
8Gemma 3 4B (IT)7.1
9Qwen 2 VL 72B7.1
10Qwen 2 VL 7B7.1
11Claude 3.5 Sonnet (20241022)7.1
12MiniCPM-V-2.67.1
13Gemini 1.5 Flash (002)7.1
14Gemma 3 27B (IT)0
15Gemma 3 12B (IT)0

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-visual-prediction-rater-novel-view-synthesis · How the rankings work · Data refreshed daily, snapshot 2026-07-22.