MPT-30B-Chat: benchmark results
Provider: Databricks. Access: Open.
Unified ELO 1353 ± 12, rank #2211 of 2656 rated models, from 88 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - College Mathematics | 38 | Accuracy (%) | 89.4 |
| MMLU-by-task - TruthfulQA MC2 | 52.42 | Accuracy (%) | 86.5 |
| MMLU-by-task - HellaSwag | 63.53 | Accuracy (%) | 83.5 |
| MMLU-by-task - Abstract Algebra | 34 | Accuracy (%) | 82.1 |
| MMLU-by-task - High School Mathematics | 30.37 | Accuracy (%) | 79.4 |
| MMLU-by-task - High School US History | 76.47 | Accuracy (%) | 79.3 |
| MMLU-by-task - College Medicine | 52.02 | Accuracy (%) | 77.9 |
| MMLU-by-task - Business Ethics | 56 | Accuracy (%) | 77.8 |
| MMLU-by-task - College Physics | 31.37 | Accuracy (%) | 77.5 |
| MMLU-by-task - Global Facts | 37 | Accuracy (%) | 76.2 |
| MMLU-by-task - TruthfulQA MC1 | 34.15 | Accuracy (%) | 76.1 |
| MMLU-by-task - College Biology | 59.03 | Accuracy (%) | 74.5 |
Interactive version: theaggregate.ai/model?slug=mpt-30b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.