Yi-34Bx2-MoE-60B-DPO — benchmark results

cloudyu's DPO-tuned version of their 2x34B Yi-based mixture-of-experts, Yi-34Bx2-MoE-60B. Provider: 01.AI. Released 2024-01-23. Access: Open.

Unified ELO 1490 ± 17, rank #840 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM Leaderboard69.46Average Score (%)96.1
Open Chinese LLM - C-Eval Semantic90.57Accuracy (%)95.3
Open Chinese LLM - ARC Challenge64.08Accuracy (%)95
Open Chinese LLM - WinoGrande70.64Accuracy (%)94.7
Open Chinese LLM - HellaSwag69.68Accuracy (%)92.6
Open Chinese LLM - CMMLU71.11Accuracy (%)90.8
Open LLM Leaderboard - MMLU-Pro40.85Score85.7
Open Chinese LLM - GSM8K60.35Accuracy (%)85.2
Open Chinese LLM - TruthfulQA MC59.79Accuracy (%)82.5
Open LLM Leaderboard - MuSR14.32Score78.3
Open LLM Leaderboard - GPQA9.62Score76.6
Open LLM Leaderboard - IFEval53.19Score63.3

Interactive version: theaggregate.ai/model?slug=yi-34bx2-moe-60b-dpo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.