SEA LLM Leaderboard - SeaBench - Vietnamese (Public): leaderboard

Metric: Public Judge Score (1-10). Source: huggingface.co. 41 models tracked.

Top models

#ModelScore
1GPT-4.18.99
2Gemini 1.5 Pro8.85
3GPT-4o (2024-08-06)8.78
4DeepSeek V3 (0324)8.75
5Claude 3.5 Sonnet (20241022)8.74
6GPT-4.1 Mini8.7
7Claude 3.7 Sonnet (20250219)8.7
8Gemini 2.0 Flash8.59
9Gemma 3 27B (IT)8.55
10Gemini 1.5 Flash8.46
11GPT-4o Mini (2024-07-18)8.42
12Gemini 2.0 Flash Lite8.39
13Gemma 3 12B (IT)8.32
14Qwen 2.5 72B Instruct8.3
15Gemma 2 27B (IT)8.22

Interactive version: theaggregate.ai/benchmark?slug=sea-llm-leaderboard-seabench-vietnamese-public · How It Works · Data refreshed daily, snapshot 2026-09-19.