Mistral-7B-v0.1-ORPO: benchmark results

Provider: Mistral. Access: Open.

Unified ELO 1464 ± 20, rank #1603 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - WinoGrande79.16Accuracy (%) (5-shot)67.7
Open LLM Leaderboard v1 - MMLU63.57Accuracy (%) (5-shot)61.6
Open LLM Leaderboard v1 - HellaSwag83.78Normalized accuracy (%) (10-shot)61.4
Open LLM Leaderboard v1 - ARC Challenge62.54Normalized accuracy (%) (25-shot)58.6
Open LLM Leaderboard v1 - GSM8K43.29Accuracy (%) (5-shot)57.6
Open LLM Leaderboard v1 - TruthfulQA MC252.6MC2 (%) (0-shot)56.7
Open Portuguese LLM - OAB Exams43.37Accuracy (%)55.4
Open Portuguese LLM - ENEM62.56Accuracy (%)52.2
Open Portuguese LLM - BLUEX52.16Accuracy (%)51.8
Open Portuguese LLM - ASSIN2 RTE86.29Macro F1 (%)37.6
Open Portuguese LLM - FaQuAD NLI50.65Macro F1 (%)32.3

Interactive version: theaggregate.ai/model?slug=mistral-7b-v0-1-orpo · How It Works · Data refreshed daily, snapshot 2026-09-23.