Mixtral_34Bx2_MoE_60B — benchmark results

cloudyu's 2x34B mixture-of-experts merging Yi-34B-based Bagel-DPO and SUS-Chat for English and Chinese; 'Mixtral' in name only. Provider: Mistral. Released 2024-01-05. Access: Open.

Unified ELO 1494 ± 20, rank #824 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM Leaderboard69.41Average Score (%)95.5
Open Chinese LLM - WinoGrande70.8Accuracy (%)95.1
Open Chinese LLM - C-Eval Semantic90.49Accuracy (%)94.7
Open Chinese LLM - ARC Challenge63.99Accuracy (%)94.4
Open Chinese LLM - HellaSwag69.64Accuracy (%)92
Open LLM Leaderboard - MuSR17.78Score89.4
Open Chinese LLM - CMMLU70.88Accuracy (%)89
Open LLM Leaderboard - MMLU-Pro41.85Score86.5
Open Chinese LLM - GSM8K60.12Accuracy (%)84.7
Open LLM Leaderboard - GPQA11.74Score83.7
Open Chinese LLM - TruthfulQA MC59.94Accuracy (%)83.4
Open LLM Leaderboard - BBH41.21Score80.4

Interactive version: theaggregate.ai/model?slug=mixtral-34bx2-moe-60b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.