llamion-14B-chat: benchmark results

Provider: Other. Access: Open.

Unified ELO 1497 ± 17, rank #1126 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond28.28Normalized accuracy (%)96.6
Open Korean LLM - KorNAT-CKA31.56Normalized accuracy (%)87
Open Korean LLM Leaderboard41.19Average Score (%)81.6
Open Ko-LLM Leaderboard41.19Average (%)81.4
Open Korean LLM - Ko-EQ-Bench31.5EQ-Bench score80.7
Open Korean LLM - Ko-GSM8K (flexible extract)37.6Exact match, flexible extract (%)71.7
Open Korean LLM - Ko-Winogrande61.56Accuracy (%)63
Open Korean LLM - KorNAT-Harmless63.09Normalized accuracy (%)55.4
Open Korean LLM - KorNAT-Helpful46.05Normalized accuracy (%)41.8
Open Korean LLM - Ko-IFEval26.52Strict accuracy, prompt/instruction mean (%)39.1

Interactive version: theaggregate.ai/model?slug=llamion-14b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.