MixTAO-7Bx2-MoE-v8.1 — benchmark results

zhengr's experimental 2x7B Mistral mixture-of-experts (~13B), a top scorer among small MoEs on the early-2024 Open LLM Leaderboard. Provider: Other. Released 2024-02-26. Access: Open.

Unified ELO 1422 ± 13, rank #1122 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC64.5Accuracy (%)96.1
Open LLM Leaderboard - MuSR15.29Score82.4
Open Korean LLM Leaderboard378.34Average Score (%)74.3
Open Chinese LLM - WinoGrande65.04Accuracy (%)70.8
Open Chinese LLM - HellaSwag61.49Accuracy (%)63.4
Open LLM Leaderboard - BBH32.31Score60.7
Open Chinese LLM Leaderboard57.73Average Score (%)60.5
Open Chinese LLM - ARC Challenge53.33Accuracy (%)55.6
Open LLM Leaderboard - GPQA6.49Score54.5
Open Chinese LLM - GSM8K46.32Accuracy (%)53.1
Open LLM Leaderboard - MATH Level 59.06Score44.4
Open LLM Leaderboard - IFEval41.88Score42.7

Interactive version: theaggregate.ai/model?slug=mixtao-7bx2-moe-v8-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.