MEGA-Bench Task - Code Translation Advanced: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)28.6
2GPT-4o14.3
3Gemini 1.5 Pro (002)10.7
4Gemma 3 27B (IT)7.1
5InternVL3-8B7.1
6InternVL2-8B7.1
7Gemini 2.5 Pro (Preview 03-25)7.1
8Claude 3.5 Sonnet (20240620)7.1
9Gemma 3 12B (IT)0
10Gemma 3 4B (IT)0
11InternVL3-78B0
12Qwen 2 VL 72B0
13Qwen 2 VL 7B0
14InternVL3-38B0
15Qwen 2 VL 2B0

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-code-translation-advanced · How It Works · Data refreshed daily, snapshot 2026-09-05.