MEGA-Bench Task - Multilingual Ruozhiba Explanation French: leaderboard

Metric: Task Score (%). Source: huggingface.co. 44 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro (Preview 03-25)79.3
2GPT-4o67.9
3InternVL3-78B65.7
4InternVL3-38B64.3
5Claude 3.5 Sonnet (20241022)59.3
6InternVL2.5-78B54.3
7InternVL3-8B50
8Claude 3.5 Sonnet (20240620)47.9
9Llama 4 Scout Base45
10Gemma 3 12B (IT)43.6
11GPT-4o Mini42.9
12Gemma 3 27B (IT)40.7
13Qwen 2 VL 72B37.1
14Qwen 2 VL 7B35
15InternVL2-8B34.3

Interactive version: theaggregate.ai/benchmark?slug=mega-bench-task-multilingual-ruozhiba-explanation-french · How It Works · Data refreshed daily, snapshot 2026-09-05.