Nous-Hermes-2-SUS-Chat-34B-Slerp: benchmark results
Provider: Nous Research. Released 2024-01-02. Access: Open.
Unified ELO 1584 ± 32, rank #696 of 2656 rated models, from 13 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Chinese LLM - WinoGrande | 70.24 | Accuracy (%) | 93.3 |
| Open Portuguese LLM - BLUEX | 68.01 | Accuracy (%) | 90.7 |
| Open Portuguese LLM - OAB Exams | 56.08 | Accuracy (%) | 89.3 |
| Open Chinese LLM - HellaSwag | 68.64 | Accuracy (%) | 89 |
| Open Chinese LLM - C-Eval Semantic | 88.73 | Accuracy (%) | 88.6 |
| Open Portuguese LLM - FaQuAD NLI | 79.77 | Macro F1 (%) | 88.3 |
| Open Chinese LLM Leaderboard | 67.32 | Average Score (%) | 87.8 |
| Open Chinese LLM - ARC Challenge | 59.9 | Accuracy (%) | 86.8 |
| Open Chinese LLM - CMMLU | 70.42 | Accuracy (%) | 86.6 |
| Open Portuguese LLM - ENEM | 73.9 | Accuracy (%) | 85.9 |
| Open Chinese LLM - GSM8K | 58.38 | Accuracy (%) | 80.9 |
| Open Portuguese LLM - ASSIN2 RTE | 92.32 | Macro F1 (%) | 77.6 |
Interactive version: theaggregate.ai/model?slug=nous-hermes-2-sus-chat-34b-slerp · How It Works · Data refreshed daily, snapshot 2026-09-19.