EEVE-Korean_Instruct-10.8B-expo: benchmark results

Provider: Yanolja. Released 2024-07-12. Access: Open.

Unified ELO 1561 ± 17, rank #792 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-EQ-Bench53.59EQ-Bench score96.3
Open Ko-LLM Leaderboard47.99Average (%)95.5
Open Korean LLM Leaderboard47.99Average Score (%)95.5
Open Korean LLM - Ko-Winogrande69.38Accuracy (%)94.8
Open Korean LLM - KorNAT-CKA34.34Normalized accuracy (%)93.8
Open Korean LLM - Ko-GSM8K (flexible extract)51.18Exact match, flexible extract (%)84.7
Open Korean LLM - KorNAT-Harmless65.88Normalized accuracy (%)83.4
Open Korean LLM - Ko-IFEval37.55Strict accuracy, prompt/instruction mean (%)78.7
Open Korean LLM - KorNAT-Helpful48.5Normalized accuracy (%)69.2
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6

Interactive version: theaggregate.ai/model?slug=eeve-korean-instruct-10-8b-expo · How It Works · Data refreshed daily, snapshot 2026-09-19.