Chinese-Mixtral-8x7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1492 ± 16, rank #1338 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU70.95Accuracy (%) (5-shot)94.5
Open LLM Leaderboard v1 - WinoGrande82.08Accuracy (%) (5-shot)82.2
Open LLM Leaderboard v1 - HellaSwag85.98Normalized accuracy (%) (10-shot)77.8
Open Chinese LLM - WinoGrande64.48Accuracy (%)66.9
Open LLM Leaderboard v1 - GSM8K51.71Accuracy (%) (5-shot)63.7
Open LLM Leaderboard v1 - ARC Challenge63.57Normalized accuracy (%) (25-shot)63.3
Open Chinese LLM - HellaSwag60.74Accuracy (%)57.9
Open Chinese LLM - CMMLU54.43Accuracy (%)57.3
Open Chinese LLM - ARC Challenge53.07Accuracy (%)52.7
Open Chinese LLM - C-Eval Semantic65.32Accuracy (%)39.2
Open Chinese LLM Leaderboard54.68Average Score (%)34.1
Open LLM Leaderboard v1 - TruthfulQA MC245.86MC2 (%) (0-shot)32.6

Interactive version: theaggregate.ai/model?slug=chinese-mixtral-8x7b · How It Works · Data refreshed daily, snapshot 2026-09-23.