Yi-1.5-9B-32K: benchmark results

Provider: 01.AI. Released 2024-05-13. Access: Open.

Unified ELO 1428 ± 1, rank #1036 of 1392 rated models, from 178 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA14.54Score90.4
Open Medical LLM - MMLU College Medicine67.63Accuracy (%)85.5
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7
Open Medical LLM - MMLU Anatomy65.93Accuracy (%)73.9
MERA - ruCodeEval30.18pass@1 (%)73.7
Open Chinese LLM - CMMLU63.02Accuracy (%)72.7
Open Chinese LLM - C-Eval Semantic80.95Accuracy (%)70
MERA - ruHumanEval24.82pass@1 (%)68.8
Open Chinese LLM - WinoGrande64.72Accuracy (%)68.5
Open Chinese LLM - ARC Challenge55.2Accuracy (%)68.4
Open Chinese LLM - HellaSwag62.5Accuracy (%)67.4
Open CoT - LogiQA5.27CoT Gain (%)65.6

Interactive version: theaggregate.ai/model?slug=yi-1-5-9b-32k · How It Works · Data refreshed daily, snapshot 2026-09-05.