yi-ko-6B-dpo-further: benchmark results

Provider: 01.AI. Access: Open.

Unified ELO 1397 ± 17, rank #1938 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-CKA28.99Normalized accuracy (%)78.1
Open Korean LLM - Ko-Winogrande61.25Accuracy (%)60.9
Open Korean LLM - Ko-EQ-Bench0.93EQ-Bench score46.4
Open Korean LLM Leaderboard33.26Average Score (%)40.3
Open Ko-LLM Leaderboard33.26Average (%)40
Open Korean LLM - Ko-IFEval26.47Strict accuracy, prompt/instruction mean (%)39
Open Korean LLM - Ko-GSM8K (flexible extract)11.83Exact match, flexible extract (%)37.6
Open Korean LLM - KorNAT-Helpful43.8Normalized accuracy (%)25.5
Open Korean LLM - KorNAT-Harmless59.65Normalized accuracy (%)8
Open Korean LLM - Ko-GPQA-Diamond18.69Normalized accuracy (%)4.1

Interactive version: theaggregate.ai/model?slug=yi-ko-6b-dpo-further · How It Works · Data refreshed daily, snapshot 2026-09-19.