eeve_dpo-v3: benchmark results

Provider: Yanolja. Released 2024-02-27. Access: Open.

Unified ELO 1558 ± 18, rank #807 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-EQ-Bench61.55EQ-Bench score99.7
Open Korean LLM - Ko-Winogrande72.06Accuracy (%)97.8
Open Korean LLM - KorNAT-CKA36.15Normalized accuracy (%)96.3
Open Korean LLM - KorNAT-Harmless71.9Normalized accuracy (%)95
Open Korean LLM Leaderboard47.37Average Score (%)94.9
Open Ko-LLM Leaderboard47.37Average (%)94.8
Open Korean LLM - KorNAT-Helpful50.15Normalized accuracy (%)84.2
Open Korean LLM - Ko-IFEval32.87Strict accuracy, prompt/instruction mean (%)64.2
Open Korean LLM - Ko-GPQA-Diamond24.24Normalized accuracy (%)62.4
Open Korean LLM - Ko-GSM8K (flexible extract)21.38Exact match, flexible extract (%)53.7

Interactive version: theaggregate.ai/model?slug=eeve-dpo-v3 · How It Works · Data refreshed daily, snapshot 2026-09-19.