EEVE-10.8B-Multiturn: benchmark results

Provider: Yanolja. Access: Open.

Unified ELO 1539 ± 17, rank #894 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard45.96Average Score (%)92.4
Open Ko-LLM Leaderboard45.96Average (%)92.3
Open Korean LLM - Ko-GSM8K (flexible extract)55.57Exact match, flexible extract (%)89.5
Open Korean LLM - Ko-IFEval44.9Strict accuracy, prompt/instruction mean (%)89.2
Open Korean LLM - Ko-Winogrande66.54Accuracy (%)88.5
Open Korean LLM - Ko-EQ-Bench36.98EQ-Bench score87.6
Open Korean LLM - KorNAT-CKA31.18Normalized accuracy (%)86.1
Open Korean LLM - KorNAT-Helpful46.62Normalized accuracy (%)47.9
Open Korean LLM - KorNAT-Harmless62.03Normalized accuracy (%)37.2
Open Korean LLM - Ko-GPQA-Diamond20.2Normalized accuracy (%)13.9

Interactive version: theaggregate.ai/model?slug=eeve-10-8b-multiturn · How It Works · Data refreshed daily, snapshot 2026-09-19.