OpenHermes-2.5-Mistral-7B — benchmark results
Provider: Other. Released 2023-10-29. Access: Open.
Unified ELO 1364 ± 17, rank #1363 of 1776 rated models, from 38 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 55.71 | Score | 67.5 |
| Open LLM Leaderboard - MuSR | 12.06 | Score | 65.4 |
| Open PL LLM - Multiple Choice | 47.7 | Average Multiple-Choice Score (%) | 62.2 |
| Open PL LLM Leaderboard | 51.59 | Average Score (%) | 61.9 |
| Open PL LLM - Generative | 54.58 | Average Generative Score (%) | 59.8 |
| Open PL LLM - RAG | 60.85 | Average RAG Score (%) | 59.4 |
| BiGGen-Bench | 3.46 | Average Score (1-5) | 56.9 |
| LiveBench Story Generation | 64.92 | Score | 55.6 |
| Open CoT - LSAT Analytical Reasoning | 3.91 | CoT Gain (%) | 50.8 |
| Open LLM Leaderboard - BBH | 27.77 | Score | 44.4 |
| LiveBench Olympiad | 36.8 | Score | 43.1 |
| LiveBench Table Join | 6.76 | Score | 43.1 |
Interactive version: theaggregate.ai/model?slug=openhermes-2-5-mistral-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.