NeuralMona_MoE-4x7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1484 ± 33, rank #1238 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC63.11Accuracy (%)93.2
Open Portuguese LLM - ASSIN2 RTE92.44Macro F1 (%)79
Open Portuguese LLM - FaQuAD NLI76.94Macro F1 (%)78.1
Open Chinese LLM - GSM8K47.38Accuracy (%)57.9
Open Portuguese LLM - BLUEX53.41Accuracy (%)55.9
Open Portuguese LLM - ENEM63.12Accuracy (%)54.8
Open Chinese LLM - HellaSwag60.54Accuracy (%)53.4
Open Portuguese LLM - OAB Exams42.14Accuracy (%)50.4
Open Chinese LLM - ARC Challenge52.39Accuracy (%)49.4
Open Chinese LLM - WinoGrande62.83Accuracy (%)49.1
Open Chinese LLM Leaderboard56.35Average Score (%)46.6
Open Chinese LLM - C-Eval Semantic61.25Accuracy (%)23.7

Interactive version: theaggregate.ai/model?slug=neuralmona-moe-4x7b · How It Works · Data refreshed daily, snapshot 2026-09-19.