Yi-34B-200K-DARE-merge-v7: benchmark results

Provider: 01.AI. Access: Open.

Unified ELO 1560 ± 16, rank #835 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU77.3Accuracy (%) (5-shot)98.5
Open Chinese LLM - WinoGrande70.4Accuracy (%)93.8
Open Chinese LLM - ARC Challenge61.6Accuracy (%)90.9
Open Chinese LLM - C-Eval Semantic88.91Accuracy (%)89.8
Open Chinese LLM - HellaSwag68.61Accuracy (%)88.6
Open LLM Leaderboard v1 - WinoGrande83.11Accuracy (%) (5-shot)87.1
Open Chinese LLM Leaderboard67.09Average Score (%)86.6
Open Chinese LLM - CMMLU70.21Accuracy (%)85.8
Open LLM Leaderboard v1 - GSM8K65.35Accuracy (%) (5-shot)79.9
Open LLM Leaderboard v1 - ARC Challenge68.09Normalized accuracy (%) (25-shot)79.3
Open LLM Leaderboard v1 - HellaSwag85.99Normalized accuracy (%) (10-shot)77.9
Open Chinese LLM - GSM8K54.51Accuracy (%)74.6

Interactive version: theaggregate.ai/model?slug=yi-34b-200k-dare-merge-v7 · How It Works · Data refreshed daily, snapshot 2026-09-23.