Yi-9B: benchmark results

Provider: 01.AI. Released 2024-03-01. Access: Open.

Unified ELO 1399 ± 1, rank #1135 of 1392 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA9.06Score73.8
Open Chinese LLM - C-Eval Semantic82.42Accuracy (%)72.7
Open Chinese LLM - CMMLU61.66Accuracy (%)71.2
Open Chinese LLM - HellaSwag62.12Accuracy (%)66
Open Chinese LLM - WinoGrande64.25Accuracy (%)65.7
Open Chinese LLM Leaderboard58.34Average Score (%)63.2
Open LLM Leaderboard - MMLU-Pro28.6Score53.9
ARC Challenge (AI2)55.6Accuracy (%)51.3
Open Chinese LLM - ARC Challenge52.82Accuracy (%)51.3
WinoGrande73Accuracy (%)48.1
MMLU68.4Accuracy (%)47.4
HellaSwag76.4Accuracy (%)45.4

Interactive version: theaggregate.ai/model?slug=yi-9b · How It Works · Data refreshed daily, snapshot 2026-09-05.