Tsunami-0.5-7B-Instruct: benchmark results

Provider: Other. Access: Open.

Unified ELO 1521 ± 1, rank #593 of 1392 rated models, from 33 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 550.45Score97.2
Open LLM Leaderboard - IFEval74Score88.9
Open LLM Leaderboard - MMLU-Pro37.92Score81.8
Open LLM Leaderboard - BBH36.14Score73.9
Thai LLM NLU - xnli.tha_seacrowd_pairs39.18Accuracy (%)73.9
Thai LLM NLU - wisesight_thai_sentiment_seacrowd_text49.12Accuracy (%)72.5
Thai LLM - Coding6.91Rating (0-10)71.1
Thai LLM - Reasoning5.55Rating (0-10)66.9
Open LLM Leaderboard - MuSR12.21Score66.5
Open LLM Leaderboard - GPQA7.83Score66.2
Thai LLM NLU - xcopa_tha_seacrowd_qa88.2Accuracy (%)65.2
Thai LLM - STEM6.25Rating (0-10)63.4

Interactive version: theaggregate.ai/model?slug=tsunami-0-5-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.