Mistral 7B: benchmark results

Provider: Mistral. Released 2023-09-27. Access: Open.

Unified ELO 1393 ± 1, rank #1165 of 1392 rated models, from 42 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
The Wrong Kind of Right26.8MAR Disability (self-reported)83.3
T-Eval56Overall Score (%)60
MHGraphBench42.1Avg$_{All^\ast}$ (self-reported)50
RedCode61.7Score (%)50
DiBiMT48.31Avg Accuracy (%)47.4
AutoRace26Average Score (%, six reasoning tasks)44.4
Diagnosing LLM Arbitration Behavior over Pre-e-19Margin (self-reported)33.3
LegalCiteBench58.5Overall (Norm.) (self-reported)32.5
ENAMEL15.2eff@1 (self-reported)29
PhysicsFinals11.7Score (self-reported)26.6
CRUXEval34.3Output Prediction pass@1 (%)26.2
AgentBoard24.6Progress Rate (self-reported)25

Interactive version: theaggregate.ai/model?slug=mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.