SEA-HELM (Vietnamese) - SEA-MT-Bench (LLM Judge): leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Qwen 3.6 27B86.87
2Qwen 3.5 122B A10B86.58
3Qwen 3.5 27B86.18
4Qwen 3.6 35B A3B85.96
5Gemma 4 31B (IT)85.63
6Gemma 4 26B A4B (IT)84.88
7Qwen 3.5 35B A3B84.59
8Gemma 4 12B (IT)82.95
9Qwen 3 VL 32B Instruct81.17
10Mistral Medium 3.581.14
11Qwen 3 VL 8B Instruct79.95
12Qwen 3.5 9B78.44
13gemma-4-E4B-it78.07
14Gemma 3 27B (IT)77.82
15Mistral Small 476.82

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-vietnamese-sea-mt-bench-llm-judge · How It Works · Data refreshed daily, snapshot 2026-09-19.