dolly-v2-3B — benchmark results

Provider: Databricks. Released 2023-04-17. Access: Open.

Unified ELO 1149 ± 14, rank #1739 of 1776 rated models, from 74 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Econometrics28.07Accuracy (%)47.2
MMLU-by-task - Abstract Algebra29Accuracy (%)45.3
MMLU-by-task - Machine Learning29.46Accuracy (%)35.1
MMLU-by-task - Electrical Engineering30.34Accuracy (%)32.9
MMLU-by-task - Elementary Mathematics26.46Accuracy (%)32.5
MMLU-by-task - Global Facts30Accuracy (%)30
MMLU-by-task - High School World History28.27Accuracy (%)27.9
MMLU-by-task - Management31.07Accuracy (%)27.7
MMLU-by-task - HellaSwag48.91Accuracy (%)27.6
MMLU-by-task - Virology30.72Accuracy (%)26.8
MMLU-by-task - Public Relations30.91Accuracy (%)26
MMLU-by-task - High School Biology27.74Accuracy (%)25.6

Interactive version: theaggregate.ai/model?slug=dolly-v2-3b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.