MEGA-Bench Task - Code Translation Advanced — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)28.6
2GPT-4o14.3
3Gemini 2.0 Flash (Preview)14.3
4Gemini 1.5 Pro (002)10.7
5Gemini 2.5 Pro7.1
6Gemma 3 27B (IT)7.1
7InternVL2-8B7.1
8InternVL3-8B7.1
9MiniCPM-V-2.67.1
10Claude 3.5 Sonnet (20240620)7.1
11Gemma 3 12B (IT)0
12Gemma 3 4B (IT)0
13InternVL3-78B0
14Qwen 2 VL 72B0
15Qwen 2 VL 7B0

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-code-translation-advanced · How the rankings work · Data refreshed daily, snapshot 2026-07-22.