Nous-Hermes-2-Mistral-7B-DPO: benchmark results

Provider: Nous Research. Released 2024-01-15. Access: Open.

Unified ELO 1428 ± 1, rank #1038 of 1392 rated models, from 32 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval57.63Score69.5
RewardBench74.81Score (%)68.5
Open Medical LLM - PubMedQA74.8Accuracy (%)66.2
BiGGen-Bench3.49Average Score (1-5)60.8
RewardBench Safety82.43Accuracy (%)55.9
LogicKor - Reasoning6Score (0-10)53.8
RewardBench Chat Hard60.53Accuracy (%)48.6
Open LLM Leaderboard - GPQA5.7Score47.8
Open Medical LLM - MedQA (USMLE)53.1Accuracy (%)45.7
Open LLM Leaderboard - BBH27.79Score44.5
LogicKor - Coding7Score (0-10)43.9
Open Medical LLM - MedMCQA49.01Accuracy (%)43.8

Interactive version: theaggregate.ai/model?slug=nous-hermes-2-mistral-7b-dpo · How It Works · Data refreshed daily, snapshot 2026-09-05.