llama3.1-typhoon2-8B-instruct: benchmark results
Provider: Meta. Access: Open.
Unified ELO 1480 ± 27, rank #1280 of 2656 rated models, from 35 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGE1) | 76.61 | ROUGE1 | 97 |
| Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGE2) | 63.19 | ROUGE2 | 97 |
| Thai LLM NLG - iapp_squad_seacrowd_qa (ROUGEL) | 76.42 | ROUGEL | 97 |
| Thai LLM NLG - flores200_tha_Thai_eng_Latn_seacrowd_t2t (BLEU) | 50.56 | BLEU | 85.1 |
| Thai LLM NLG - flores200_eng_Latn_tha_Thai_seacrowd_t2t (BLEU) | 27.36 | BLEU | 83.6 |
| Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE1) | 30.3 | ROUGE1 | 82.1 |
| Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGE2) | 10.56 | ROUGE2 | 82.1 |
| Thai LLM NLG - xl_sum_tha_seacrowd_t2t (ROUGEL) | 21.02 | ROUGEL | 80.6 |
| Thai LLM NLG - flores200_eng_Latn_tha_Thai_seacrowd_t2t (SacreBLEU) | 37.26 | SacreBLEU | 77.6 |
| Thai LLM NLG - flores200_tha_Thai_eng_Latn_seacrowd_t2t (SacreBLEU) | 33.92 | SacreBLEU | 77.6 |
| Thai LLM - Knowledge III | 4.55 | Rating (0-10) | 74.6 |
| Thai LLM NLG - flores200_eng_Latn_tha_Thai_seacrowd_t2t (chrF++) | 52.72 | chrF++ | 74.6 |
Interactive version: theaggregate.ai/model?slug=llama3-1-typhoon2-8b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-19.