MEGA-Bench Task - Visualization With Code: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro (Preview 03-25)77.9
2Claude 3.5 Sonnet (20241022)66.4
3Claude 3.5 Sonnet (20240620)65
4GPT-4o63.6
5Gemini 1.5 Flash (002)57.1
6GPT-4o Mini51.4
7Gemini 1.5 Pro (002)51.4
8Qwen 2 VL 72B49.3
9Gemma 3 27B (IT)47.9
10InternVL3-78B45
11InternVL3-38B42.1
12InternVL2.5-78B39.3
13Pixtral-12B37.1
14Gemma 3 12B (IT)31.4
15Qwen 2 VL 7B29.3

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-visualization-with-code · How It Works · Data refreshed daily, snapshot 2026-09-05.