MixtureofMerges-MoE-4x7B-v5 — benchmark results

jsfs11's LazyMergekit 4x7B MoE routing OmniBeagleSquaredMBX, AlphaMonarch, Neural4gsm8k and NeutrixOmnibe-DPO experts by task. Provider: Other. Released 2024-02-25. Access: Open.

Unified ELO 1412 ± 12, rank #1169 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC62.58Accuracy (%)91.4
Open LLM Leaderboard - MuSR12.34Score67.4
Open Chinese LLM - WinoGrande64.09Accuracy (%)64.2
Open LLM Leaderboard - BBH32.83Score63.2
Open Chinese LLM - ARC Challenge53.67Accuracy (%)58.8
Open Chinese LLM - GSM8K47.54Accuracy (%)58.5
Open Chinese LLM Leaderboard57.05Average Score (%)57.9
Open Chinese LLM - HellaSwag60.7Accuracy (%)57
Open LLM Leaderboard - IFEval41.99Score42.9
Open LLM Leaderboard - MMLU-Pro23.31Score39.9
Open LLM Leaderboard - GPQA4.59Score39.4
Open LLM Leaderboard - MATH Level 57.55Score39.3

Interactive version: theaggregate.ai/model?slug=mixtureofmerges-moe-4x7b-v5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.