multimaster-7B-v6 — benchmark results

ibivibiv's Mixtral-style multi-discipline MoE built from LoRA-tuned OpenChat-3.5 7B experts, part of a series testing MoE gate tuning. Provider: Other. Released 2024-02-24. Access: Open.

Unified ELO 1419 ± 14, rank #1138 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC60.33Accuracy (%)83.7
Open LLM Leaderboard - MuSR13.38Score73.7
Open Chinese LLM - WinoGrande65.04Accuracy (%)70.8
Open LLM Leaderboard - BBH32.4Score61.1
Open LLM Leaderboard - GPQA7.16Score60.3
Open Chinese LLM - GSM8K47.61Accuracy (%)59.1
Open Chinese LLM - ARC Challenge53.33Accuracy (%)55.6
Open Chinese LLM Leaderboard56.76Average Score (%)54
Open Chinese LLM - HellaSwag59.99Accuracy (%)49
Open LLM Leaderboard - IFEval44.73Score48.9
Open LLM Leaderboard - MMLU-Pro23.28Score39.8
Open Chinese LLM - C-Eval Semantic63.48Accuracy (%)33.5

Interactive version: theaggregate.ai/model?slug=multimaster-7b-v6 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.