openbuddy-mistral2-7B-v20.3-32k: benchmark results

Provider: Other. Access: Open.

Unified ELO 1367 ± 17, rank #2127 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond25.25Normalized accuracy (%)75.9
Open Korean LLM - Ko-EQ-Bench3.7EQ-Bench score49.8
Open Korean LLM - Ko-GSM8K (flexible extract)15.39Exact match, flexible extract (%)44.9
Open Korean LLM - KorNAT-Helpful46.27Normalized accuracy (%)44.1
Open Korean LLM - KorNAT-CKA21.32Normalized accuracy (%)34.2
Open Korean LLM - KorNAT-Harmless61.23Normalized accuracy (%)25.4
Open Korean LLM Leaderboard31.01Average Score (%)24
Open Ko-LLM Leaderboard31.01Average (%)23.8
Open Korean LLM - Ko-IFEval21.52Strict accuracy, prompt/instruction mean (%)21.2
Open Korean LLM - Ko-Winogrande51.78Accuracy (%)7.3

Interactive version: theaggregate.ai/model?slug=openbuddy-mistral2-7b-v20-3-32k · How It Works · Data refreshed daily, snapshot 2026-09-19.