OpenHermes-2.5-Mistral-7B: benchmark results
Provider: Other. Released 2023-10-29. Access: Open.
Unified ELO 1424 ± 1, rank #1054 of 1392 rated models, from 30 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 55.71 | Score | 67.5 |
| Open LLM Leaderboard - MuSR | 12.06 | Score | 65.4 |
| Open PL LLM - Multiple Choice | 47.7 | Average Multiple-Choice Score (%) | 62.2 |
| Open PL LLM Leaderboard | 51.59 | Average Score (%) | 61.9 |
| Open PL LLM - Generative | 54.58 | Average Generative Score (%) | 59.8 |
| Open PL LLM - RAG | 60.85 | Average RAG Score (%) | 59.4 |
| BiGGen-Bench | 3.46 | Average Score (1-5) | 56.9 |
| Open CoT - LSAT Analytical Reasoning | 3.91 | CoT Gain (%) | 50.8 |
| Open LLM Leaderboard - BBH | 27.77 | Score | 44.4 |
| AlpacaEval 2.0 | 16.25 | LC Win Rate (%) | 41.7 |
| BenchBench | 40.1 | Aggregate Score (%) | 39 |
| Open CoT - LSAT Reading Comprehension | 9.29 | CoT Gain (%) | 38.9 |
Interactive version: theaggregate.ai/model?slug=openhermes-2-5-mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.