Evals for Every Language - Language ku — leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)70.01
2Grok 4.2067.12
3Claude Opus 4.866.53
4Claude Opus 4.766.38
5Gemini 3.1 Flash Lite66.14
6Claude Sonnet 4.564.5
7Claude Sonnet 4.664.2
8GPT-5.264.01
9Gemini 2.5 Pro63.77
10Qwen 3.6 Plus63.54
11GPT-5.163.44
12GPT-5.563.41
13GPT-5.463.33
14GPT-563.09
15Nova Pro (v1)62.37

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-ku · How the rankings work · Data refreshed daily, snapshot 2026-07-22.