Nous-Hermes-2-SUS-Chat-34B-Slerp: benchmark results

Provider: Nous Research. Released 2024-01-02. Access: Open.

Unified ELO 1584 ± 32, rank #696 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande70.24Accuracy (%)93.3
Open Portuguese LLM - BLUEX68.01Accuracy (%)90.7
Open Portuguese LLM - OAB Exams56.08Accuracy (%)89.3
Open Chinese LLM - HellaSwag68.64Accuracy (%)89
Open Chinese LLM - C-Eval Semantic88.73Accuracy (%)88.6
Open Portuguese LLM - FaQuAD NLI79.77Macro F1 (%)88.3
Open Chinese LLM Leaderboard67.32Average Score (%)87.8
Open Chinese LLM - ARC Challenge59.9Accuracy (%)86.8
Open Chinese LLM - CMMLU70.42Accuracy (%)86.6
Open Portuguese LLM - ENEM73.9Accuracy (%)85.9
Open Chinese LLM - GSM8K58.38Accuracy (%)80.9
Open Portuguese LLM - ASSIN2 RTE92.32Macro F1 (%)77.6

Interactive version: theaggregate.ai/model?slug=nous-hermes-2-sus-chat-34b-slerp · How It Works · Data refreshed daily, snapshot 2026-09-19.