Mistral-7B-v0.1-flashback-v2: benchmark results

Provider: Mistral. Released 2023-12-04. Access: Open.

Unified ELO 1428 ± 20, rank #1913 of 2928 rated models, from 32 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - WinoGrande77.19Accuracy (%) (5-shot)54
Open LLM Leaderboard v1 - GSM8K29.42Accuracy (%) (5-shot)46.7
Open LLM Leaderboard v1 - MMLU59.98Accuracy (%) (5-shot)46.4
Open LLM Leaderboard v1 - HellaSwag80.74Normalized accuracy (%) (10-shot)42.2
EuroEval Italian NLU - MultiNERD IT56.62Named entity recognition Score (%)41.9
Open LLM Leaderboard v1 - ARC Challenge57.17Normalized accuracy (%) (25-shot)36.8
EuroEval Dutch NLU - DBRD74.48Sentiment classification Score (%)30.5
EuroEval Danish Knowledge21.47Knowledge Average Score (%)29.4
EuroEval Spanish NLU - ScaLA ES1.23Linguistic acceptability Score (%)28.3
EuroEval Danish Knowledge - Danish Citizen Tests21.47MCC (x100)26.7
EuroEval Spanish NLU - CoNLL ES48.21Named entity recognition Score (%)26.6
EuroEval English Knowledge24Knowledge Average Score (%)20.5

Interactive version: theaggregate.ai/model?slug=mistral-7b-v0-1-flashback-v2 · How It Works · Data refreshed daily, snapshot 2026-09-23.