Yi-9B-Forest-DPO-v1.0: benchmark results
Provider: 01.AI. Released 2024-05-01. Access: Open.
Unified ELO 1487 ± 15, rank #1388 of 2928 rated models, from 17 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Medical LLM - MMLU College Medicine | 71.68 | Accuracy (%) | 96 |
| Open LLM Leaderboard v1 - MMLU | 70.02 | Accuracy (%) (5-shot) | 93.2 |
| Open Medical LLM - MMLU College Biology | 80.56 | Accuracy (%) | 88.6 |
| Open Medical LLM - MMLU Clinical Knowledge | 75.09 | Accuracy (%) | 81.5 |
| Open Medical LLM - PubMedQA | 75.8 | Accuracy (%) | 78.4 |
| Open Medical LLM | 68.93 | Average Accuracy (%) | 63.9 |
| Open Medical LLM - MMLU Medical Genetics | 79 | Accuracy (%) | 63.4 |
| Open Medical-LLM Leaderboard | 68.93 | Medical average (%) | 63.3 |
| Open Medical LLM - MMLU Professional Medicine | 72.06 | Accuracy (%) | 62.2 |
| Open LLM Leaderboard v1 - GSM8K | 48.37 | Accuracy (%) (5-shot) | 61.6 |
| Open Medical LLM - MMLU Anatomy | 62.96 | Accuracy (%) | 61.6 |
| Open LLM Leaderboard v1 - WinoGrande | 76.87 | Accuracy (%) (5-shot) | 51.3 |
Interactive version: theaggregate.ai/model?slug=yi-9b-forest-dpo-v1-0 · How It Works · Data refreshed daily, snapshot 2026-09-23.