Yi-34Bx2-MOE-200K: benchmark results

Provider: 01.AI. Access: Open.

Unified ELO 1566 ± 16, rank #815 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K72.71Accuracy (%) (5-shot)98
Open LLM Leaderboard v1 - MMLU76.64Accuracy (%) (5-shot)97.8
Open Chinese LLM - ARC Challenge64.08Accuracy (%)95
Open Chinese LLM - C-Eval Semantic90.21Accuracy (%)93.8
Open Chinese LLM - WinoGrande70.09Accuracy (%)92.7
Open Chinese LLM Leaderboard68.25Average Score (%)90.7
Open Chinese LLM - HellaSwag69.06Accuracy (%)90.5
Open LLM Leaderboard v1 - TruthfulQA MC268.19MC2 (%) (0-shot)87.2
Open Chinese LLM - CMMLU70.22Accuracy (%)86.1
Open LLM Leaderboard v1 - ARC Challenge70.48Normalized accuracy (%) (25-shot)86.1
Open LLM Leaderboard v1 - WinoGrande82.72Accuracy (%) (5-shot)85.2
Open Chinese LLM - TruthfulQA MC59.23Accuracy (%)80.7

Interactive version: theaggregate.ai/model?slug=yi-34bx2-moe-200k · How It Works · Data refreshed daily, snapshot 2026-09-23.