Evals for Every Language - Language sv — leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)77.13
2Gemini 3.1 Flash Lite76.58
3Claude Opus 4.875.68
4Claude Opus 4.774.85
5Claude Sonnet 4.674.31
6Mistral Medium 3.173.73
7GPT-5.173.67
8Claude Sonnet 473.37
9GPT-5.273.12
10Llama 3.1 70B Instruct72.88
11Gemini 2.5 Pro72.72
12GPT-5.572.71
13Claude Sonnet 4.572.28
14GPT-572.26
15Claude Haiku 4.572.25

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-sv · How the rankings work · Data refreshed daily, snapshot 2026-07-22.