MEGA-Bench Task - Code Translation Easy: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)78.6
2GPT-4o71.4
3Claude 3.5 Sonnet (20240620)71.4
4InternVL2.5-78B42.9
5InternVL3-78B39.3
6Gemini 1.5 Pro (002)34.5
7Gemma 3 27B (IT)28.6
8Qwen 2 VL 72B28.6
9InternVL3-38B28.6
10GPT-4o Mini28.6
11InternVL3-8B21.4
12Qwen 2 VL 7B21.4
13Gemini 1.5 Flash (002)21.4
14Gemma 3 12B (IT)7.1
15Gemma 3 4B (IT)7.1

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-code-translation-easy · How It Works · Data refreshed daily, snapshot 2026-09-05.