OpenHermes-2.5-Mistral-7B: benchmark results

Provider: Other. Released 2023-10-29. Access: Open.

Unified ELO 1424 ± 1, rank #1054 of 1392 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval55.71Score67.5
Open LLM Leaderboard - MuSR12.06Score65.4
Open PL LLM - Multiple Choice47.7Average Multiple-Choice Score (%)62.2
Open PL LLM Leaderboard51.59Average Score (%)61.9
Open PL LLM - Generative54.58Average Generative Score (%)59.8
Open PL LLM - RAG60.85Average RAG Score (%)59.4
BiGGen-Bench3.46Average Score (1-5)56.9
Open CoT - LSAT Analytical Reasoning3.91CoT Gain (%)50.8
Open LLM Leaderboard - BBH27.77Score44.4
AlpacaEval 2.016.25LC Win Rate (%)41.7
BenchBench40.1Aggregate Score (%)39
Open CoT - LSAT Reading Comprehension9.29CoT Gain (%)38.9

Interactive version: theaggregate.ai/model?slug=openhermes-2-5-mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.