Mistral 7B Instruct (v0.2): benchmark results

Provider: Mistral. Released 2023-12-11. Access: Open.

Unified ELO 1391 ± 1, rank #1173 of 1392 rated models, from 175 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AlpacaEval 1.092.78Win Rate (%)84.2
Open Chinese LLM - TruthfulQA MC58.78Accuracy (%)78.6
SpeechMap Compliance81.5% Requests Completed78.6
EconLogicQA0.32Accuracy76.5
CyberMetric77.09Accuracy (%)75
MERA - ruCodeEval27.5pass@1 (%)70.8
MERA - ruHumanEval25.98pass@1 (%)69.7
BiGGen-Bench3.62Average Score (1-5)69.6
MERA - RWSD60Accuracy (%)68.7
Open LLM Leaderboard - IFEval54.96Score66.3
Enkrypt AI - Toxicity Risk2.09Risk Score65.8
Open CoT - LogiQA5.27CoT Gain (%)65.6

Interactive version: theaggregate.ai/model?slug=mistral-7b-instruct-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-05.