SEA-HELM (Filipino) - SEA-MT-Bench (LLM Judge): leaderboard

Metric: Normalized Score. Source: leaderboard.sea-lion.ai. 44 models tracked.

Top models

#ModelScore
1Gemma 4 31B (IT)82.83
2Gemma 4 26B A4B (IT)82.18
3Qwen 3.5 122B A10B81.87
4Qwen 3.5 27B81.74
5Qwen 3.6 27B80.28
6Gemma 4 12B (IT)80.26
7Qwen 3.6 35B A3B79.74
8Qwen 3.5 35B A3B78.99
9Mistral Medium 3.578.93
10Qwen 3 VL 32B Instruct77.62
11Gemma 3 27B (IT)76.38
12gemma-4-E4B-it76.36
13Gemma 3 12B (IT)73.58
14Mistral Small 471.86
15Gemma 4 E2B (IT)70.87

Interactive version: theaggregate.ai/benchmark?slug=sea-helm-filipino-sea-mt-bench-llm-judge · How It Works · Data refreshed daily, snapshot 2026-09-19.