Evals for Every Language - Language uk — leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)73.69
2Gemini 2.5 Pro73.08
3Claude Sonnet 4.573.07
4Claude Sonnet 4.672.42
5GPT-4o72.27
6Gemini 3.1 Flash Lite72.22
7GPT-571.89
8Claude Sonnet 471.77
9GPT-5.171.72
10Nova Pro (v1)71.42
11Claude Haiku 4.571.28
12Mistral Medium 3.171.14
13Grok 4.2071.04
14Gemma 3 27B (IT)70.92
15GPT-5.270.35

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-uk · How the rankings work · Data refreshed daily, snapshot 2026-07-22.