chinese-mixtral-instruct: benchmark results

Provider: Other. Access: Open.

Unified ELO 1508 ± 16, rank #1129 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU71.53Accuracy (%) (5-shot)95.1
Open LLM Leaderboard v1 - WinoGrande83.11Accuracy (%) (5-shot)87.1
Open LLM Leaderboard v1 - ARC Challenge67.75Normalized accuracy (%) (25-shot)78
Open Chinese LLM - WinoGrande66.38Accuracy (%)77.9
Open LLM Leaderboard v1 - HellaSwag85.67Normalized accuracy (%) (10-shot)75.9
Open LLM Leaderboard v1 - TruthfulQA MC257.46MC2 (%) (0-shot)70.1
Open LLM Leaderboard v1 - GSM8K55.65Accuracy (%) (5-shot)67.3
Open Chinese LLM - HellaSwag62.12Accuracy (%)66
Open Chinese LLM - CMMLU56.39Accuracy (%)60.8
Open Chinese LLM Leaderboard57.56Average Score (%)60.2
Open Chinese LLM - TruthfulQA MC54.95Accuracy (%)59.9
Open Chinese LLM - ARC Challenge53.5Accuracy (%)56.7

Interactive version: theaggregate.ai/model?slug=chinese-mixtral-instruct · How It Works · Data refreshed daily, snapshot 2026-09-23.