SEA-HELM (Vietnamese) - Causal Reasoning: leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Gemma 4 31B (IT)92.29
2Qwen 3.5 122B A10B91.18
3Qwen 3.5 27B90.43
4Qwen 3 VL 32B Instruct90.28
5Gemma 4 26B A4B (IT)90.17
6Gemma 3 12B (IT)89.98
7Llama 3.3 70B Instruct89.7
8Qwen 3.6 27B89.68
9Gemma 4 12B (IT)89.56
10Qwen 3.6 35B A3B87.92
11Mistral Medium 3.587.24
12Llama 4 Scout Instruct86.94
13Gemma 3 27B (IT)85.51
14Qwen 3.5 35B A3B84.66
15gemma-4-E4B-it84.03

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-vietnamese-causal-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.