NeuralMonarch-7B: benchmark results

Provider: Other. Released 2024-03-01. Access: Open.

Unified ELO 1496 ± 14, rank #1132 of 2656 rated models, from 35 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Harmless79.7Normalized accuracy (%)98.9
Open Chinese LLM - TruthfulQA MC62.76Accuracy (%)92.6
Open Korean LLM - KorNAT-Helpful52.35Normalized accuracy (%)92.6
YALL Nous Leaderboard57.53Average92.1
Open Korean LLM - KorNAT-CKA32.82Normalized accuracy (%)89.5
Open Korean LLM Leaderboard42.37Average Score (%)86.3
Open Ko-LLM Leaderboard42.37Average (%)86.1
Open Korean LLM - Ko-GSM8K (flexible extract)43.06Exact match, flexible extract (%)78.5
Open Korean LLM - Ko-EQ-Bench26.23EQ-Bench score72.9
Open Korean LLM - Ko-IFEval33.44Strict accuracy, prompt/instruction mean (%)67
Open Korean LLM - Ko-GPQA-Diamond24.24Normalized accuracy (%)62.4
Open Korean LLM - Ko-Winogrande60.93Accuracy (%)58.7

Interactive version: theaggregate.ai/model?slug=neuralmonarch-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.