SambaLingo-Thai-Chat: benchmark results

Provider: Other. Access: Open.

Unified ELO 1349 ± 21, rank #2482 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - HellaSwag78.42Normalized accuracy (%) (10-shot)33.8
Open LLM Leaderboard v1 - GSM8K8.57Accuracy (%) (5-shot)28.7
Open LLM Leaderboard v1 - WinoGrande72.22Accuracy (%) (5-shot)28.6
Open LLM Leaderboard v1 - ARC Challenge52.73Normalized accuracy (%) (25-shot)27.7
HELM ThaiExam - A-Level26.77EM26.8
HELM ThaiExam - ONET30.86EM26.8
Open LLM Leaderboard v1 - MMLU43.95Accuracy (%) (5-shot)23.1
HELM ThaiExam - IC28.42EM15.9
Open LLM Leaderboard v1 - TruthfulQA MC240.84MC2 (%) (0-shot)15.5
HELM ThaiExam - TGAT55.38EM14.6
HELM ThaiExam - ThaiExam33.63EM14.6
HELM ThaiExam - TPAT-126.72EM7.3

Interactive version: theaggregate.ai/model?slug=sambalingo-thai-chat · How It Works · Data refreshed daily, snapshot 2026-09-23.