llama-2-koen-13B-slimOrca: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1356 ± 17, rank #2192 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande65.43Accuracy (%)84.4
Open Korean LLM - KorNAT-Harmless63.23Normalized accuracy (%)58.6
Open Korean LLM - KorNAT-CKA24.95Normalized accuracy (%)54.2
Open Korean LLM - KorNAT-Helpful46.45Normalized accuracy (%)46.5
Open Korean LLM - Ko-GPQA-Diamond21.72Normalized accuracy (%)29.4
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-GSM8K (flexible extract)5.23Exact match, flexible extract (%)24.5
Open Korean LLM Leaderboard30.47Average Score (%)19.6
Open Ko-LLM Leaderboard30.47Average (%)19.5
Open Korean LLM - Ko-IFEval0.5Strict accuracy, prompt/instruction mean (%)2.6

Interactive version: theaggregate.ai/model?slug=llama-2-koen-13b-slimorca · How It Works · Data refreshed daily, snapshot 2026-09-19.