llama3-diverce-ver1.6: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1330 ± 17, rank #2347 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond24.24Normalized accuracy (%)62.4
Open Korean LLM - Ko-IFEval23.89Strict accuracy, prompt/instruction mean (%)28.8
Open Korean LLM - Ko-Winogrande56.27Accuracy (%)25.3
Open Korean LLM Leaderboard29.87Average Score (%)14.6
Open Ko-LLM Leaderboard29.87Average (%)14.5
Open Korean LLM - KorNAT-CKA16.63Normalized accuracy (%)12.7
Open Korean LLM - Ko-GSM8K (flexible extract)0.68Exact match, flexible extract (%)10
Open Korean LLM - KorNAT-Harmless59.87Normalized accuracy (%)9.9
Open Korean LLM - KorNAT-Helpful40.98Normalized accuracy (%)9.7
Open Korean LLM - Ko-EQ-Bench-2.57EQ-Bench score3

Interactive version: theaggregate.ai/model?slug=llama3-diverce-ver1-6 · How It Works · Data refreshed daily, snapshot 2026-09-19.