Yi-1.5-dolphin-9B: benchmark results
Provider: 01.AI. Released 2024-06-01. Access: Open.
Unified ELO 1482 ± 13, rank #1436 of 2928 rated models, from 30 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard v1 - MMLU | 68.12 | Accuracy (%) (5-shot) | 90.7 |
| Open Medical LLM - MMLU College Biology | 79.17 | Accuracy (%) | 80.7 |
| Open Medical LLM - PubMedQA | 75.2 | Accuracy (%) | 71 |
| Open Chinese LLM - WinoGrande | 64.8 | Accuracy (%) | 69 |
| Open Chinese LLM - CMMLU | 59.55 | Accuracy (%) | 68 |
| Open Chinese LLM - C-Eval Semantic | 77.93 | Accuracy (%) | 66.9 |
| Open Chinese LLM Leaderboard | 58.93 | Average Score (%) | 66.8 |
| Open Chinese LLM - HellaSwag | 61.7 | Accuracy (%) | 64.4 |
| Open Medical LLM - MMLU College Medicine | 64.74 | Accuracy (%) | 64.2 |
| Open Portuguese LLM - OAB Exams | 45.51 | Accuracy (%) | 61.1 |
| Open Portuguese LLM - BLUEX | 54.38 | Accuracy (%) | 59.8 |
| Open Medical LLM - MMLU Anatomy | 62.22 | Accuracy (%) | 58.8 |
Interactive version: theaggregate.ai/model?slug=yi-1-5-dolphin-9b · How It Works · Data refreshed daily, snapshot 2026-09-23.