SEA-HELM (Tamil) - Causal Reasoning: leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Gemma 4 31B (IT)92.05
2Qwen 3.5 27B90.03
3Gemma 3 27B (IT)89.39
4Qwen 3.6 27B88.57
5Qwen 3.5 122B A10B88.34
6Gemma 4 26B A4B (IT)87.86
7Mistral Medium 3.586.04
8Qwen 3.6 35B A3B84.92
9Llama 3.3 70B Instruct84.48
10Llama 4 Scout Instruct84.29
11Gemma 3 12B (IT)82.42
12Qwen 3 VL 32B Instruct82.34
13gemma-4-E4B-it79.82
14Qwen 3.5 35B A3B76.66
15Gemma 4 12B (IT)74.91

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-tamil-causal-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.