Sailor2-1B-Chat: benchmark results

Provider: Sea AI Lab. Access: Open.

Unified ELO 1273 ± 24, rank #1493 of 1632 rated models, from 85 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Thai LLM - Writing5.55Rating (0-10)33.1
Thai LLM - Roleplay5.8Rating (0-10)31.7
Open Japanese LLM - Xlsum JA Rouge120.81Score (%)29.6
Open Japanese LLM - Xlsum JA Bert Score JA F167.11Score (%)27.9
Open Japanese LLM - Xlsum JA RougeLsum17.05Score (%)26
Thai LLM NLU - wisesight_thai_sentiment_seacrowd_text33.81Accuracy (%)18.8
Thai LLM NLG - flores200_tha_Thai_eng_Latn_seacrowd_t2t (chrF++)41.39chrF++17.9
Open Japanese LLM - SUM5.67Score (%)17.8
Open Japanese LLM - Xlsum JA Rouge25.69Score (%)17.8
Thai LLM - STEM3.6Rating (0-10)17.6
Thai LLM MC - m3exam_tha_seacrowd_qa30.12Accuracy (%)17.4
Thai LLM MC - thaiexam_qa30.62Accuracy (%)17.4

Interactive version: theaggregate.ai/model?slug=sailor2-1b-chat · How It Works · Data refreshed daily, snapshot 2026-10-08.