Evals for Every Language - Language fr — leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)78.52
2Claude Opus 4.878.43
3Claude Opus 4.778.07
4Gemini 2.5 Pro77.84
5GPT-5.577.84
6GPT-577.8
7Claude Sonnet 4.577.19
8GPT-5.276.55
9Gemini 3.1 Flash Lite76.51
10Grok 4.2076.27
11Claude Haiku 4.576.08
12GPT-5.175.77
13Mistral Medium 3.174.96
14Qwen 3.6 Plus74.83
15DeepSeek V3.174.66

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-fr · How the rankings work · Data refreshed daily, snapshot 2026-07-22.