Mistral 7B Instruct: benchmark results
Provider: Mistral. Released 2023-09-27. Access: Open.
Unified ELO 1394 ± 1, rank #1161 of 1392 rated models, from 60 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SWE-Arena | 1002 | Elo Score | 80.6 |
| LogicKor - Math | 4.71 | Score (0-10) | 53.4 |
| SnakeBench | 21.4 | TrueSkill Rating | 49.7 |
| LogicKor - Coding | 7 | Score (0-10) | 43.9 |
| FanOutQA | 42.71 | Accuracy (%, closedbook loose) | 33.3 |
| LogicKor - Multi-Turn | 4.88 | Score (0-10) | 32.4 |
| PlantMarkerBench | 0.69 | Valid F1 (self-reported) | 27 |
| LogicKor | 4.9 | Score (0-10) | 26.9 |
| AA CritPt | 0 | Accuracy (%) | 24.4 |
| LogicKor - Grammar | 3.57 | Score (0-10) | 23.9 |
| LogicKor - Writing | 5.14 | Score (0-10) | 23.9 |
| AA Humanity's Last Exam | 4.55 | Accuracy (%) | 23.8 |
Interactive version: theaggregate.ai/model?slug=mistral-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.