Sailor-0.5B-Chat: benchmark results

Provider: Sea AI Lab. Access: Open.

Unified ELO 1227 ± 19, rank #2852 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K1.82Accuracy (%) (5-shot)18.5
Open LLM Leaderboard v1 - MMLU26.73Accuracy (%) (5-shot)13.6
Open LLM Leaderboard v1 - TruthfulQA MC239.85MC2 (%) (0-shot)12.1
Open LLM Leaderboard v1 - WinoGrande56.51Accuracy (%) (5-shot)9.9
Open LLM Leaderboard v1 - ARC Challenge30.38Normalized accuracy (%) (25-shot)9.4
Open LLM Leaderboard v1 - HellaSwag45.51Normalized accuracy (%) (10-shot)9.1
SEA LLM Leaderboard - SeaExam - Indonesian (Public)27.5Public Accuracy (%)3.3
SEA LLM Leaderboard - SeaExam - Thai (Public)26.9Public Accuracy (%)3.3
SEA LLM Leaderboard - SeaExam (Public)26.7Public Average Score (%)2.2
SEA LLM Leaderboard - SeaExam - Vietnamese (Private)28.5Private Accuracy (%)2.2
SEA LLM Leaderboard - SeaExam26.3Private Average Score (%)1.7
SEA LLM Leaderboard - SeaExam - Thai (Private)24.9Private Accuracy (%)1.7

Interactive version: theaggregate.ai/model?slug=sailor-0-5b-chat · How It Works · Data refreshed daily, snapshot 2026-09-23.