MEGA-Bench Task - Code Translation Easy — leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)78.6
2GPT-4o71.4
3Claude 3.5 Sonnet (20240620)71.4
4Gemini 2.0 Flash (Preview)59.5
5InternVL2.5-78B42.9
6InternVL3-78B39.3
7InternVL3-14B35.7
8Gemini 1.5 Pro (002)34.5
9Ovis2-8B32.1
10Gemma 3 27B (IT)28.6
11Qwen 2 VL 72B28.6
12InternVL3-38B28.6
13GPT-4o Mini28.6
14InternVL3-8B21.4
15Qwen 2 VL 7B21.4

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-code-translation-easy · How the rankings work · Data refreshed daily, snapshot 2026-07-22.