Nous-Hermes-2-Mistral-7B-DPO — benchmark results

Provider: Nous Research. Released 2024-01-15. Access: Open.

Unified ELO 1384 ± 18, rank #1295 of 1776 rated models, from 32 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval57.63Score69.5
RewardBench74.81Score (%)68.5
Open Medical LLM - PubMedQA74.8Accuracy (%)66.2
BiGGen-Bench3.49Average Score (1-5)60.8
LogicKor - Reasoning6Score (0-10)56.2
RewardBench Safety82.43Accuracy (%)55.9
RewardBench Chat Hard60.53Accuracy (%)48.6
Open LLM Leaderboard - GPQA5.7Score47.8
LogicKor - Coding7Score (0-10)46.2
LogicKor - Multi-Turn5.57Score (0-10)46
Open Medical LLM - MedQA (USMLE)53.1Accuracy (%)45.7
LogicKor - Writing6.92Score (0-10)44.5

Interactive version: theaggregate.ai/model?slug=nous-hermes-2-mistral-7b-dpo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.