SEA-HELM (Tamil) - Natural Language Inference: leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Gemma 4 31B (IT)58.54
2Gemma 3 27B (IT)55.12
3Gemma 4 26B A4B (IT)49.84
4Qwen 3.5 27B47.71
5Gemma 4 12B (IT)45.94
6Llama 3.3 70B Instruct44.97
7Qwen 3 VL 32B Instruct44.85
8Qwen 3.5 122B A10B44.83
9Llama 4 Scout Instruct43.95
10Gemma 3 12B (IT)41.59
11Qwen 3.5 35B A3B40.11
12Qwen 3.6 35B A3B39.35
13Mistral Medium 3.533.82
14Gemma 3 4B (IT)32.19
15Mistral Small 430.4

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-tamil-natural-language-inference · How It Works · Data refreshed daily, snapshot 2026-09-19.