mistralopithecus-v1-dpo: benchmark results

Provider: Mistral. Access: Open.

Unified ELO 1477 ± 17, rank #1318 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-CKA34.79Normalized accuracy (%)94.6
Open Korean LLM - KorNAT-Helpful52.45Normalized accuracy (%)93
Open Korean LLM - Ko-GPQA-Diamond27.27Normalized accuracy (%)92.4
Open Korean LLM Leaderboard39.64Average Score (%)73.1
Open Ko-LLM Leaderboard39.64Average (%)72.8
Open Korean LLM - Ko-Winogrande63.06Accuracy (%)72.1
Open Korean LLM - Ko-GSM8K (flexible extract)31.84Exact match, flexible extract (%)65.8
Open Korean LLM - Ko-EQ-Bench17.16EQ-Bench score63
Open Korean LLM - Ko-IFEval30.25Strict accuracy, prompt/instruction mean (%)55.3
Open Korean LLM - KorNAT-Harmless62.43Normalized accuracy (%)43.9

Interactive version: theaggregate.ai/model?slug=mistralopithecus-v1-dpo · How It Works · Data refreshed daily, snapshot 2026-09-19.