Yi-1.5-dolphin-9B: benchmark results

Provider: 01.AI. Released 2024-06-01. Access: Open.

Unified ELO 1482 ± 13, rank #1436 of 2928 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU68.12Accuracy (%) (5-shot)90.7
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7
Open Medical LLM - PubMedQA75.2Accuracy (%)71
Open Chinese LLM - WinoGrande64.8Accuracy (%)69
Open Chinese LLM - CMMLU59.55Accuracy (%)68
Open Chinese LLM - C-Eval Semantic77.93Accuracy (%)66.9
Open Chinese LLM Leaderboard58.93Average Score (%)66.8
Open Chinese LLM - HellaSwag61.7Accuracy (%)64.4
Open Medical LLM - MMLU College Medicine64.74Accuracy (%)64.2
Open Portuguese LLM - OAB Exams45.51Accuracy (%)61.1
Open Portuguese LLM - BLUEX54.38Accuracy (%)59.8
Open Medical LLM - MMLU Anatomy62.22Accuracy (%)58.8

Interactive version: theaggregate.ai/model?slug=yi-1-5-dolphin-9b · How It Works · Data refreshed daily, snapshot 2026-09-23.