Nous-Hermes-13B: benchmark results
Provider: Nous Research. Access: Open.
Unified ELO 1370 ± 10, rank #2349 of 2928 rated models, from 77 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - Global Facts | 40 | Accuracy (%) | 88.6 |
| MMLU-by-task - Formal Logic | 38.89 | Accuracy (%) | 83.9 |
| MMLU-by-task - TruthfulQA MC2 | 51.5 | Accuracy (%) | 83 |
| MMLU-by-task - TruthfulQA MC1 | 35.37 | Accuracy (%) | 82.5 |
| MMLU-by-task - Human Sexuality | 63.36 | Accuracy (%) | 76.3 |
| MMLU-by-task - HellaSwag | 62.22 | Accuracy (%) | 75 |
| MMLU-by-task - Machine Learning | 37.5 | Accuracy (%) | 71.9 |
| MMLU-by-task - Management | 71.84 | Accuracy (%) | 71.8 |
| MMLU-by-task - US Foreign Policy | 79 | Accuracy (%) | 69.9 |
| MMLU-by-task - ARC Challenge | 54.95 | Accuracy (%) | 69 |
| MMLU-by-task - Sociology | 71.14 | Accuracy (%) | 68.9 |
| MMLU-by-task - Professional Psychology | 52.78 | Accuracy (%) | 67.5 |
Interactive version: theaggregate.ai/model?slug=nous-hermes-13b · How It Works · Data refreshed daily, snapshot 2026-09-23.