ko-llama2-13B-OrcaPlatypus: benchmark results

Provider: Other. Access: Open.

Unified ELO 1370 ± 17, rank #2110 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande63.06Accuracy (%)72.1
Open Korean LLM - KorNAT-CKA25.4Normalized accuracy (%)57.9
Open Korean LLM - KorNAT-Harmless62.23Normalized accuracy (%)40.7
Open Korean LLM - Ko-GSM8K (flexible extract)11.22Exact match, flexible extract (%)36
Open Korean LLM - Ko-IFEval24.98Strict accuracy, prompt/instruction mean (%)32
Open Korean LLM Leaderboard31.2Average Score (%)26.3
Open Ko-LLM Leaderboard31.2Average (%)26.1
Open Korean LLM - KorNAT-Helpful42.5Normalized accuracy (%)17
Open Korean LLM - Ko-GPQA-Diamond19.7Normalized accuracy (%)9.6
Open Korean LLM - Ko-EQ-Bench-11.21EQ-Bench score2

Interactive version: theaggregate.ai/model?slug=ko-llama2-13b-orcaplatypus · How It Works · Data refreshed daily, snapshot 2026-09-19.