Sailor-1.8B-Chat: benchmark results

Provider: Sea AI Lab. Access: Open.

Unified ELO 1295 ± 20, rank #2712 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K3.56Accuracy (%) (5-shot)21.7
Open LLM Leaderboard v1 - MMLU38.31Accuracy (%) (5-shot)20.1
SEA LLM Leaderboard - SeaExam - Thai (Private)33.6Private Accuracy (%)14.4
Open LLM Leaderboard v1 - ARC Challenge35.75Normalized accuracy (%) (25-shot)13.3
Open LLM Leaderboard v1 - HellaSwag57.12Normalized accuracy (%) (10-shot)12.9
Open LLM Leaderboard v1 - WinoGrande59.12Accuracy (%) (5-shot)12.3
SEA LLM Leaderboard - SeaExam - Indonesian (Public)35.2Public Accuracy (%)10
Open LLM Leaderboard v1 - TruthfulQA MC238.71MC2 (%) (0-shot)8.8
SEA LLM Leaderboard - SeaExam (Public)35Public Average Score (%)7.8
SEA LLM Leaderboard - SeaExam - Vietnamese (Private)40.9Private Accuracy (%)7.8
SEA LLM Leaderboard - SeaExam - Vietnamese (Public)39.2Public Accuracy (%)7.8
SEA LLM Leaderboard - SeaExam36.2Private Average Score (%)6.7

Interactive version: theaggregate.ai/model?slug=sailor-1-8b-chat · How It Works · Data refreshed daily, snapshot 2026-09-23.