llama-3-Korean-8B-r-v1: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1437 ± 17, rank #1619 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GSM8K (flexible extract)37.38Exact match, flexible extract (%)71.5
Open Korean LLM - Ko-IFEval33.84Strict accuracy, prompt/instruction mean (%)68.9
Open Korean LLM - KorNAT-Helpful48.48Normalized accuracy (%)68.6
Open Korean LLM Leaderboard36.72Average Score (%)58.5
Open Ko-LLM Leaderboard36.72Average (%)58.4
Open Korean LLM - KorNAT-CKA25Normalized accuracy (%)54.4
Open Korean LLM - Ko-EQ-Bench2.36EQ-Bench score48.5
Open Korean LLM - KorNAT-Harmless62.11Normalized accuracy (%)38.1
Open Korean LLM - Ko-GPQA-Diamond21.72Normalized accuracy (%)29.4
Open Korean LLM - Ko-Winogrande56.75Accuracy (%)27.6

Interactive version: theaggregate.ai/model?slug=llama-3-korean-8b-r-v1 · How It Works · Data refreshed daily, snapshot 2026-09-19.