MixTAO-7Bx2-MoE-v8.1: benchmark results

zhengr's experimental 2x7B Mistral mixture-of-experts (~13B), a top scorer among small MoEs on the early-2024 Open LLM Leaderboard. Provider: Other. Released 2024-02-26. Access: Open.

Unified ELO 1501 ± 1, rank #684 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC64.5Accuracy (%)96.1
Open Korean LLM Leaderboard45.51Average Score (%)91.7
Open LLM Leaderboard - MuSR15.29Score82.4
Open Chinese LLM - WinoGrande65.04Accuracy (%)70.8
Open Chinese LLM - HellaSwag61.49Accuracy (%)63.4
Open LLM Leaderboard - BBH32.31Score60.6
Open Chinese LLM Leaderboard57.73Average Score (%)60.5
Open Chinese LLM - ARC Challenge53.33Accuracy (%)55.6
Open LLM Leaderboard - GPQA6.49Score54.5
Open Chinese LLM - GSM8K46.32Accuracy (%)53.1
Open LLM Leaderboard - MATH Level 59.06Score44.4
Open LLM Leaderboard - IFEval41.88Score42.7

Interactive version: theaggregate.ai/model?slug=mixtao-7bx2-moe-v8-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.