SEA-HELM (Vietnamese) - Natural Language Inference: leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Gemma 4 31B (IT)65.49
2Llama 3.3 70B Instruct60.23
3Gemma 3 12B (IT)57.67
4Gemma 4 26B A4B (IT)56.91
5Gemma 3 27B (IT)55.94
6Qwen 3.6 27B53.29
7Qwen 3.5 122B A10B51.61
8Qwen 3.5 27B51.46
9Qwen 3 VL 32B Instruct51.11
10Gemma 4 12B (IT)50.49
11Qwen 3 VL 4B Instruct49.97
12Qwen 3.6 35B A3B49.65
13Qwen 3 VL 8B Instruct47.81
14Qwen 3.5 35B A3B43.87
15Mistral Medium 3.542.79

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-vietnamese-natural-language-inference · How It Works · Data refreshed daily, snapshot 2026-09-19.