Yi-1.5-9B-32K — benchmark results

Provider: 01.AI. Released 2024-05-13. Access: Open.

Unified ELO 1365 ± 18, rank #1360 of 1776 rated models, from 155 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA14.54Score90.4
Open Medical LLM - MMLU College Medicine67.63Accuracy (%)85.5
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7
Open Medical LLM - MMLU Anatomy65.93Accuracy (%)73.9
Open Chinese LLM - CMMLU63.02Accuracy (%)72.7
Open Chinese LLM - C-Eval Semantic80.95Accuracy (%)70
Open Chinese LLM - WinoGrande64.72Accuracy (%)68.5
Open Chinese LLM - ARC Challenge55.2Accuracy (%)68.4
Open Chinese LLM - HellaSwag62.5Accuracy (%)67.4
Open CoT - LogiQA5.27CoT Gain (%)65.6
Open LLM Leaderboard - MMLU-Pro30.72Score63.3
Open CoT - LogiQA 28.72CoT Gain (%)61.8

Interactive version: theaggregate.ai/model?slug=yi-1-5-9b-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.