MPT-30B-Chat: benchmark results

Provider: Databricks. Access: Open.

Unified ELO 1353 ± 12, rank #2211 of 2656 rated models, from 88 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Mathematics38Accuracy (%)89.4
MMLU-by-task - TruthfulQA MC252.42Accuracy (%)86.5
MMLU-by-task - HellaSwag63.53Accuracy (%)83.5
MMLU-by-task - Abstract Algebra34Accuracy (%)82.1
MMLU-by-task - High School Mathematics30.37Accuracy (%)79.4
MMLU-by-task - High School US History76.47Accuracy (%)79.3
MMLU-by-task - College Medicine52.02Accuracy (%)77.9
MMLU-by-task - Business Ethics56Accuracy (%)77.8
MMLU-by-task - College Physics31.37Accuracy (%)77.5
MMLU-by-task - Global Facts37Accuracy (%)76.2
MMLU-by-task - TruthfulQA MC134.15Accuracy (%)76.1
MMLU-by-task - College Biology59.03Accuracy (%)74.5

Interactive version: theaggregate.ai/model?slug=mpt-30b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.