SEA-HELM (Thai) - SEA-MT-Bench (LLM Judge): leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Qwen 3.5 27B83.98
2Qwen 3.5 122B A10B83.82
3Qwen 3.6 27B83.3
4Qwen 3.6 35B A3B82.56
5Gemma 4 31B (IT)82.24
6Gemma 4 26B A4B (IT)81.89
7Qwen 3.5 35B A3B81.63
8Qwen 3 VL 32B Instruct81.43
9Gemma 4 12B (IT)80.56
10Qwen 3 VL 8B Instruct78.28
11Qwen 3.5 9B77.06
12Mistral Medium 3.576.25
13gemma-4-E4B-it75.92
14Gemma 3 27B (IT)75.45
15Gemma 3 12B (IT)73.82

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-thai-sea-mt-bench-llm-judge · How It Works · Data refreshed daily, snapshot 2026-09-19.