SEA-HELM (Tamil) - Linguistic Diagnostics: leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Gemma 4 31B (IT)75.24
2Gemma 4 26B A4B (IT)72.4
3Qwen 3.5 27B71.71
4Qwen 3 VL 32B Instruct71.68
5Qwen 3.5 122B A10B71.59
6Gemma 3 27B (IT)71.18
7Qwen 3.6 27B69.51
8Llama 4 Scout Instruct67.28
9Qwen 3.6 35B A3B66.57
10Mistral Medium 3.563.77
11Gemma 4 12B (IT)63.72
12Gemma 3 12B (IT)59.46
13Llama 3.3 70B Instruct55.57
14gemma-4-E4B-it55.37
15Qwen 3 VL 8B Instruct52.09

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-tamil-linguistic-diagnostics · How It Works · Data refreshed daily, snapshot 2026-09-19.