Mixolar-4x7B — benchmark results
shadowml's mergekit MoE of four SOLAR-10.7B fine-tunes (Sakura-SOLAR, CarbonVillain, meow, SOLRCA-Math) despite the 4x7B name. Provider: Other. Released 2023-12-30. Access: Open.
Unified ELO 1409 ± 13, rank #1179 of 1776 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Chinese LLM - TruthfulQA MC | 61.09 | Accuracy (%) | 86.6 |
| Open LLM Leaderboard - MuSR | 12.72 | Score | 69.7 |
| Open LLM Leaderboard - BBH | 32.73 | Score | 62.7 |
| Open Chinese LLM - ARC Challenge | 54.01 | Accuracy (%) | 61.9 |
| Open Chinese LLM Leaderboard | 56.8 | Average Score (%) | 54.9 |
| Open Chinese LLM - GSM8K | 46.1 | Accuracy (%) | 52.1 |
| Open Chinese LLM - WinoGrande | 62.83 | Accuracy (%) | 49.1 |
| Open LLM Leaderboard - GPQA | 5.7 | Score | 47.8 |
| Open LLM Leaderboard - MMLU-Pro | 25.62 | Score | 46.3 |
| Open Chinese LLM - HellaSwag | 59.53 | Accuracy (%) | 45.4 |
| Open LLM Leaderboard - IFEval | 38.93 | Score | 38.6 |
| Open Chinese LLM - C-Eval Semantic | 64.09 | Accuracy (%) | 35.6 |
Interactive version: theaggregate.ai/model?slug=mixolar-4x7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.