Yi-9B — benchmark results

Provider: 01.AI. Released 2024-03-01. Access: Open.

Unified ELO 1371 ± 21, rank #1339 of 1776 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA9.06Score73.8
Open Chinese LLM - C-Eval Semantic82.42Accuracy (%)72.7
Open Chinese LLM - CMMLU61.66Accuracy (%)71.2
Open Chinese LLM - HellaSwag62.12Accuracy (%)66
Open Chinese LLM - WinoGrande64.25Accuracy (%)65.7
Open Chinese LLM Leaderboard58.34Average Score (%)63.2
Open LLM Leaderboard - MMLU-Pro28.6Score53.9
Open Chinese LLM - ARC Challenge52.82Accuracy (%)51.3
ARC Challenge (AI2)55.6Accuracy (%)50
WinoGrande73Accuracy (%)48.1
MMLU68.4Accuracy (%)47.4
HellaSwag76.4Accuracy (%)45.4

Interactive version: theaggregate.ai/model?slug=yi-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.