MEGA-Bench Task - Visualization With Code — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro77.9
2Gemini 2.0 Flash (Preview)67.1
3Claude 3.5 Sonnet (20241022)66.4
4Claude 3.5 Sonnet (20240620)65
5GPT-4o63.6
6Gemini 1.5 Flash (002)57.1
7GPT-4o Mini51.4
8Gemini 1.5 Pro (002)51.4
9Qwen 2 VL 72B49.3
10Gemma 3 27B (IT)47.9
11InternVL3-78B45
12InternVL3-38B42.1
13InternVL3-14B41.4
14InternVL2.5-78B39.3
15Pixtral-12B37.1

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-visualization-with-code · How the rankings work · Data refreshed daily, snapshot 2026-07-22.