Tsunami-1.0-14B-Instruct: benchmark results

Provider: Other. Access: Open.

Unified ELO 1574 ± 1, rank #344 of 1392 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval78.29Score94.7
Open LLM Leaderboard - MATH Level 545.85Score94
Thai LLM MC - thaiexam_qa61.06Accuracy (%)92.8
Open LLM Leaderboard - MMLU-Pro47.21Score91.1
Thai LLM MC - m3exam_tha_seacrowd_qa63.05Accuracy (%)90.6
Open LLM Leaderboard - BBH49.15Score89.9
Open LLM Leaderboard - GPQA14.21Score89.8
Thai LLM NLU - xnli.tha_seacrowd_pairs42.57Accuracy (%)88.4
Thai LLM NLG - flores200_tha_Thai_eng_Latn_seacrowd_t2t (chrF++)59.96chrF++88.1
Open LLM Leaderboard - MuSR16.34Score85.5
Thai LLM NLU - wisesight_thai_sentiment_seacrowd_text51.18Accuracy (%)85.5
Thai LLM - Math6.45Rating (0-10)79.6

Interactive version: theaggregate.ai/model?slug=tsunami-1-0-14b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.