Yi-Ko-6B-dpo-v5: benchmark results

Provider: 01.AI. Access: Open.

Unified ELO 1399 ± 17, rank #1913 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Harmless70.06Normalized accuracy (%)93.3
Open Korean LLM - Ko-Winogrande61.4Accuracy (%)61.7
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM Leaderboard33.35Average Score (%)41.3
Open Ko-LLM Leaderboard33.35Average (%)41
Open Korean LLM - KorNAT-CKA22.59Normalized accuracy (%)40.3
Open Korean LLM - Ko-IFEval24.16Strict accuracy, prompt/instruction mean (%)29.1
Open Korean LLM - KorNAT-Helpful43.95Normalized accuracy (%)26.6
Open Korean LLM - Ko-GSM8K (flexible extract)5.99Exact match, flexible extract (%)25.9
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5

Interactive version: theaggregate.ai/model?slug=yi-ko-6b-dpo-v5 · How It Works · Data refreshed daily, snapshot 2026-09-19.