dolly-v2-3B — benchmark results
Provider: Databricks. Released 2023-04-17. Access: Open.
Unified ELO 1149 ± 14, rank #1739 of 1776 rated models, from 74 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - Econometrics | 28.07 | Accuracy (%) | 47.2 |
| MMLU-by-task - Abstract Algebra | 29 | Accuracy (%) | 45.3 |
| MMLU-by-task - Machine Learning | 29.46 | Accuracy (%) | 35.1 |
| MMLU-by-task - Electrical Engineering | 30.34 | Accuracy (%) | 32.9 |
| MMLU-by-task - Elementary Mathematics | 26.46 | Accuracy (%) | 32.5 |
| MMLU-by-task - Global Facts | 30 | Accuracy (%) | 30 |
| MMLU-by-task - High School World History | 28.27 | Accuracy (%) | 27.9 |
| MMLU-by-task - Management | 31.07 | Accuracy (%) | 27.7 |
| MMLU-by-task - HellaSwag | 48.91 | Accuracy (%) | 27.6 |
| MMLU-by-task - Virology | 30.72 | Accuracy (%) | 26.8 |
| MMLU-by-task - Public Relations | 30.91 | Accuracy (%) | 26 |
| MMLU-by-task - High School Biology | 27.74 | Accuracy (%) | 25.6 |
Interactive version: theaggregate.ai/model?slug=dolly-v2-3b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.