Nous-Hermes-2-SOLAR-10.7B: benchmark results

Provider: Nous Research. Released 2024-01-01. Access: Open.

Unified ELO 1464 ± 1, rank #881 of 1392 rated models, from 20 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard40.94Average Score (%)77
Open LLM Leaderboard - MuSR13.83Score76.1
Open PL LLM - Multiple Choice53.08Average Multiple-Choice Score (%)72.4
Open PL LLM Leaderboard56.09Average Score (%)71.3
Open PL LLM - RAG67.78Average RAG Score (%)71
Open LLM Leaderboard - BBH34.99Score70.4
Open Chinese LLM - TruthfulQA MC56.42Accuracy (%)70.3
Open PL LLM - Generative58.41Average Generative Score (%)67.1
Open LLM Leaderboard - IFEval52.79Score62.7
Open LLM Leaderboard - MMLU-Pro27.31Score50.2
Open LLM Leaderboard - GPQA5.82Score48.7
Polish EQ-Bench49.85EQ-Bench Score43.6

Interactive version: theaggregate.ai/model?slug=nous-hermes-2-solar-10-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.