llama-2-ko-7B-pru: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1254 ± 18, rank #2574 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - KorNAT-Helpful42.6Normalized accuracy (%)17.6
Open Korean LLM - KorNAT-Harmless60.37Normalized accuracy (%)14.1
Open Korean LLM - Ko-GSM8K (flexible extract)1.52Exact match, flexible extract (%)13.9
Open Korean LLM - Ko-Winogrande51.14Accuracy (%)5.5
Open Korean LLM - KorNAT-CKA10.24Normalized accuracy (%)1.9
Open Korean LLM Leaderboard26.52Average Score (%)1.3
Open Ko-LLM Leaderboard26.52Average (%)1.2
Open Korean LLM - Ko-IFEval0.15Strict accuracy, prompt/instruction mean (%)0.8

Interactive version: theaggregate.ai/model?slug=llama-2-ko-7b-pru · How It Works · Data refreshed daily, snapshot 2026-09-19.