llama3-eng-ko-8B-sl5: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1472 ± 17, rank #1360 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-IFEval50.25Strict accuracy, prompt/instruction mean (%)93.6
Open Korean LLM - KorNAT-Helpful51Normalized accuracy (%)88.5
Open Korean LLM - Ko-EQ-Bench32.98EQ-Bench score82.5
Open Korean LLM Leaderboard39.97Average Score (%)74.6
Open Ko-LLM Leaderboard39.97Average (%)74.4
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM - Ko-GSM8K (flexible extract)20.85Exact match, flexible extract (%)53
Open Korean LLM - KorNAT-CKA20.21Normalized accuracy (%)28.9
Open Korean LLM - Ko-Winogrande56.2Accuracy (%)25
Open Korean LLM - KorNAT-Harmless61.06Normalized accuracy (%)22.3

Interactive version: theaggregate.ai/model?slug=llama3-eng-ko-8b-sl5 · How It Works · Data refreshed daily, snapshot 2026-09-19.