Tsunami-0.5x-7B-Instruct: benchmark results

Provider: Other. Access: Open.

Unified ELO 1539 ± 1, rank #489 of 1392 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 542.07Score91.6
Open LLM Leaderboard - MuSR18.57Score91.3
Thai LLM NLU - xnli.tha_seacrowd_pairs41.96Accuracy (%)87
Open LLM Leaderboard - IFEval70.99Score84.2
Open LLM Leaderboard - MMLU-Pro38.42Score82.7
Open LLM Leaderboard - BBH37.36Score77
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE2)10.26ROUGE276.1
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE1)29.15ROUGE171.6
Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGEL)19.55ROUGEL71.6
Open LLM Leaderboard - GPQA8.61Score71.4
Thai LLM NLU - belebele_tha_thai_seacrowd_qa81.11Accuracy (%)68.1
Thai LLM MC - m3exam_tha_seacrowd_qa54.11Accuracy (%)65.2

Interactive version: theaggregate.ai/model?slug=tsunami-0-5x-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.