YiSM-34B-0rn — benchmark results

altomek's self-merge of Yi-1.5-34B with its Chat variant, aiming to follow instructions while preserving the base model's character. Provider: 01.AI. Released 2024-05-26. Access: Open.

Unified ELO 1507 ± 26, rank #772 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K70.36Accuracy (%)96.9
Open Chinese LLM Leaderboard69.66Average Score (%)96.4
Open LLM Leaderboard - GPQA16.22Score92.8
Open Chinese LLM - ARC Challenge62.12Accuracy (%)91.8
Open Chinese LLM - C-Eval Semantic89.81Accuracy (%)91.8
Open Chinese LLM - WinoGrande70.01Accuracy (%)91.5
Open Chinese LLM - HellaSwag69.1Accuracy (%)90.8
Open Chinese LLM - CMMLU71.04Accuracy (%)90.5
Open LLM Leaderboard - MMLU-Pro41.06Score85.8
Open LLM Leaderboard - BBH45.38Score85.6
Open LLM Leaderboard - MuSR14.76Score80
Open LLM Leaderboard - MATH Level 522.81Score76.2

Interactive version: theaggregate.ai/model?slug=yism-34b-0rn · How the rankings work · Data refreshed daily, snapshot 2026-07-22.