Evals for Every Language - Language ta: leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro73.75
2Claude Opus 4.772.46
3GPT-572.25
4Gemini 3.1 Pro (Preview)71.59
5GPT-5.171.41
6Claude Sonnet 470.61
7Gemini 3.1 Flash Lite70.58
8Grok 4.2070.52
9GPT-5.270.24
10Claude Sonnet 4.569.97
11GPT-5.369.96
12GPT-5.569.92
13Qwen 3.6 Plus69.45
14Claude Sonnet 4.669.4
15Claude Opus 4.869.29

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-ta · How It Works · Data refreshed daily, snapshot 2026-09-05.