ko-gemma-7B-sft-dpo-v1.0: benchmark results

Provider: Other. Access: Open.

Unified ELO 1422 ± 17, rank #1737 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond28.28Normalized accuracy (%)96.6
Open Korean LLM - KorNAT-Helpful48.8Normalized accuracy (%)72.8
Open Korean LLM - KorNAT-Harmless64.12Normalized accuracy (%)70.8
Open Korean LLM - KorNAT-CKA26.46Normalized accuracy (%)64.6
Open Korean LLM - Ko-EQ-Bench14.25EQ-Bench score60.1
Open Korean LLM - Ko-IFEval30.87Strict accuracy, prompt/instruction mean (%)58.4
Open Korean LLM Leaderboard35.2Average Score (%)50.3
Open Ko-LLM Leaderboard35.2Average (%)50.1
Open Korean LLM - Ko-GSM8K (flexible extract)9.25Exact match, flexible extract (%)32.5
Open Korean LLM - Ko-Winogrande52.57Accuracy (%)10

Interactive version: theaggregate.ai/model?slug=ko-gemma-7b-sft-dpo-v1-0 · How It Works · Data refreshed daily, snapshot 2026-09-19.