Evals for Every Language - Language ku: leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)70.01
2Grok 4.2067.12
3GPT-5.366.86
4Claude Opus 4.866.53
5Claude Opus 4.766.38
6Gemini 3.1 Flash Lite66.14
7Claude Sonnet 4.564.5
8Claude Sonnet 4.664.2
9GPT-5.264.01
10Gemini 2.5 Pro63.77
11Qwen 3.6 Plus63.54
12GPT-5.163.44
13GPT-5.563.41
14GPT-5.463.33
15Qwen 3.6 Flash63.19

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-ku · How It Works · Data refreshed daily, snapshot 2026-09-05.