Evals for Every Language - Language ta — leaderboard

Metric: Average Score (%). Source: huggingface.co. 71 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro73.75
2Claude Opus 4.772.46
3GPT-572.25
4Gemini 3.1 Pro (Preview)71.59
5GPT-5.171.41
6Claude Sonnet 470.61
7Gemini 3.1 Flash Lite70.58
8Grok 4.2070.52
9GPT-5.270.24
10Claude Sonnet 4.569.97
11GPT-5.569.92
12Qwen 3.6 Plus69.45
13Claude Sonnet 4.669.4
14Claude Opus 4.869.29
15Mistral Medium 3.168.86

Interactive version: theaggregate.ai/benchmark?slug=evals-for-every-language-language-ta · How the rankings work · Data refreshed daily, snapshot 2026-07-22.