mpt-7B-8k: benchmark results

Provider: Databricks. Access: Open.

Unified ELO 1338 ± 20, rank #2546 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ASSIN2 RTE81.12Macro F1 (%)31.5
Open LLM Leaderboard v1 - HellaSwag77.4Normalized accuracy (%) (10-shot)30.8
Open LLM Leaderboard v1 - GSM8K8.34Accuracy (%) (5-shot)28.4
Open LLM Leaderboard v1 - WinoGrande71.11Accuracy (%) (5-shot)26
Open Portuguese LLM - ENEM32.05Accuracy (%)25.4
Open Portuguese LLM - BLUEX28.09Accuracy (%)23.9
Open LLM Leaderboard v1 - ARC Challenge47.35Normalized accuracy (%) (25-shot)22.3
Open LLM Leaderboard v1 - MMLU42.58Accuracy (%) (5-shot)22.1
Open Portuguese LLM - OAB Exams27.02Accuracy (%)21.2
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open LLM Leaderboard v1 - TruthfulQA MC236.65MC2 (%) (0-shot)4.1

Interactive version: theaggregate.ai/model?slug=mpt-7b-8k · How It Works · Data refreshed daily, snapshot 2026-09-23.