SEA LLM Leaderboard - SeaBench - Vietnamese (Private): leaderboard

Metric: Private Judge Score (1-10). Source: huggingface.co. 41 models tracked.

Top models

#ModelScore
1GPT-4.18.93
2DeepSeek V3 (0324)8.86
3Claude 3.5 Sonnet (20241022)8.78
4Claude 3.7 Sonnet (20250219)8.78
5Gemini 2.0 Flash8.75
6GPT-4o (2024-08-06)8.69
7GPT-4.1 Mini8.57
8Gemini 1.5 Pro8.57
9GPT-4o Mini (2024-07-18)8.46
10Gemma 3 27B (IT)8.45
11Gemini 2.0 Flash Lite8.3
12Gemma 3 12B (IT)8.19
13Qwen 2.5 72B Instruct8.14
14Gemini 1.5 Flash8.09
15Claude 3.5 Haiku (20241022)7.89

Interactive version: theaggregate.ai/benchmark?slug=sea-llm-leaderboard-seabench-vietnamese-private · How It Works · Data refreshed daily, snapshot 2026-09-19.