ConfigurableHermes-7B — benchmark results

Provider: Other. Released 2024-02-17. Access: Open.

Unified ELO 1370 ± 14, rank #1344 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC58.47Accuracy (%)76.9
Open LLM Leaderboard - IFEval54.11Score64.9
Open Korean LLM Leaderboard208.7Average Score (%)59.6
Open LLM Leaderboard - MuSR9.11Score44.1
Open LLM Leaderboard - MMLU-Pro22.5Score37.2
Open Chinese LLM - GSM8K38.82Accuracy (%)36.9
Open LLM Leaderboard - BBH23.16Score35.1
Open LLM Leaderboard - GPQA3.58Score31.9
Open LLM Leaderboard - MATH Level 54.76Score26.9
Open Chinese LLM Leaderboard51.53Average Score (%)23.7
Open Chinese LLM - C-Eval Semantic58.12Accuracy (%)19.6
Open Chinese LLM - HellaSwag54.17Accuracy (%)19.6

Interactive version: theaggregate.ai/model?slug=configurablehermes-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.