Llama-3-Open-Ko-8B-Instruct-seongi-ver0710: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1401 ± 18, rank #1899 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond28.79Normalized accuracy (%)98.1
Open Korean LLM - KorNAT-Harmless65.19Normalized accuracy (%)79.4
Open Korean LLM - KorNAT-Helpful48.58Normalized accuracy (%)69.9
Open Korean LLM - KorNAT-CKA24.52Normalized accuracy (%)51.8
Open Korean LLM - Ko-EQ-Bench3.85EQ-Bench score50.1
Open Korean LLM Leaderboard33.6Average Score (%)43
Open Ko-LLM Leaderboard33.6Average (%)42.7
Open Korean LLM - Ko-IFEval25.84Strict accuracy, prompt/instruction mean (%)36.9
Open Korean LLM - Ko-Winogrande55.88Accuracy (%)22.9
Open Korean LLM - Ko-GSM8K (flexible extract)1.74Exact match, flexible extract (%)15.6

Interactive version: theaggregate.ai/model?slug=llama-3-open-ko-8b-instruct-seongi-ver0710 · How It Works · Data refreshed daily, snapshot 2026-09-19.