Mistral-instruct-Y24-v6: benchmark results

Provider: Mistral. Access: Open.

Unified ELO 1326 ± 18, rank #2371 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GSM8K (flexible extract)20.62Exact match, flexible extract (%)52.6
Open Korean LLM - Ko-IFEval28.2Strict accuracy, prompt/instruction mean (%)46.7
Open Korean LLM - Ko-Winogrande59.04Accuracy (%)43.7
Open Korean LLM - KorNAT-CKA22.14Normalized accuracy (%)38.4
Open Korean LLM - Ko-GPQA-Diamond22.22Normalized accuracy (%)35
Open Korean LLM - KorNAT-Helpful42.8Normalized accuracy (%)18.8
Open Korean LLM - KorNAT-Harmless60.27Normalized accuracy (%)13
Open Korean LLM Leaderboard28.98Average Score (%)9
Open Ko-LLM Leaderboard28.98Average (%)8.8
Open Korean LLM - Ko-EQ-Bench-17.99EQ-Bench score1

Interactive version: theaggregate.ai/model?slug=mistral-instruct-y24-v6 · How It Works · Data refreshed daily, snapshot 2026-09-19.