Llama 3 10B IT Ko 2024 0527: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1485 ± 17, rank #1225 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-EQ-Bench31.15EQ-Bench score80.3
Open Korean LLM Leaderboard40.67Average Score (%)78.4
Open Ko-LLM Leaderboard40.67Average (%)78.3
Open Korean LLM - Ko-GSM8K (flexible extract)42.46Exact match, flexible extract (%)77.3
Open Korean LLM - Ko-Winogrande62.27Accuracy (%)67.7
Open Korean LLM - KorNAT-CKA25.45Normalized accuracy (%)58.3
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM - Ko-IFEval29.75Strict accuracy, prompt/instruction mean (%)52.8
Open Korean LLM - KorNAT-Helpful45.2Normalized accuracy (%)35
Open Korean LLM - KorNAT-Harmless61.39Normalized accuracy (%)27.7

Interactive version: theaggregate.ai/model?slug=llama-3-10b-it-ko-2024-0527 · How It Works · Data refreshed daily, snapshot 2026-09-19.