mistral_open_orca_ko: benchmark results

Provider: Mistral. Access: Open.

Unified ELO 1364 ± 17, rank #2146 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Helpful47.85Normalized accuracy (%)61.8
Open Korean LLM - Ko-EQ-Bench7.51EQ-Bench score53.5
Open Korean LLM - KorNAT-Harmless62.74Normalized accuracy (%)49.6
Open Korean LLM - Ko-IFEval26.13Strict accuracy, prompt/instruction mean (%)38.1
Open Korean LLM - Ko-GSM8K (flexible extract)9.55Exact match, flexible extract (%)32.8
Open Korean LLM Leaderboard31.17Average Score (%)25.9
Open Ko-LLM Leaderboard31.17Average (%)25.6
Open Korean LLM - Ko-Winogrande55.01Accuracy (%)18.1
Open Korean LLM - KorNAT-CKA13.12Normalized accuracy (%)4.3
Open Korean LLM - Ko-GPQA-Diamond17.17Normalized accuracy (%)0.9

Interactive version: theaggregate.ai/model?slug=mistral-open-orca-ko · How It Works · Data refreshed daily, snapshot 2026-09-19.