ConfigurableHermes-7B: benchmark results

Provider: Other. Released 2024-02-17. Access: Open.

Unified ELO 1418 ± 1, rank #1079 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC58.47Accuracy (%)76.9
Open LLM Leaderboard - IFEval54.11Score64.9
Open Korean LLM Leaderboard37.47Average Score (%)59.7
Open LLM Leaderboard - MuSR9.11Score44
Open LLM Leaderboard - MMLU-Pro22.5Score37.2
Open Chinese LLM - GSM8K38.82Accuracy (%)36.9
Open LLM Leaderboard - BBH23.16Score35.1
Open LLM Leaderboard - GPQA3.58Score31.9
Open LLM Leaderboard - MATH Level 54.76Score26.9
Open Chinese LLM Leaderboard51.53Average Score (%)23.7
Open Chinese LLM - C-Eval Semantic58.12Accuracy (%)19.6
Open Chinese LLM - HellaSwag54.17Accuracy (%)19.6

Interactive version: theaggregate.ai/model?slug=configurablehermes-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.