MEGA-Bench Task - Code Visualization Output Understanding: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1InternVL3-38B70
2Claude 3.5 Sonnet (20240620)60
3InternVL3-78B50
4Gemini 1.5 Pro (002)50
5Gemini 2.5 Pro (Preview 03-25)50
6Gemma 3 27B (IT)40
7GPT-4o40
8Gemma 3 12B (IT)40
9Qwen 2 VL 72B30
10Qwen 2 VL 7B30
11Claude 3.5 Sonnet (20241022)30
12GPT-4o Mini30
13Llama 4 Scout Base30
14Gemma 3 4B (IT)20
15InternVL3-8B20

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-code-visualization-output-understanding · How It Works · Data refreshed daily, snapshot 2026-09-05.