Hermes-2-Pro-Llama-3-8B — benchmark results
Nous Research's Hermes 2 Pro on Llama 3 8B, tuned on cleaned OpenHermes 2.5 data for function calling and structured JSON output. Provider: Nous Research. Released 2024-04-30. Access: Open.
Unified ELO 1410 ± 30, rank #1175 of 1776 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SWE-Arena | 1002 | Elo Score | 80.6 |
| Open PL LLM - Multiple Choice | 48.54 | Average Multiple-Choice Score (%) | 65 |
| Open PL LLM - Generative | 56.82 | Average Generative Score (%) | 64.3 |
| Open LLM Leaderboard - IFEval | 53.62 | Score | 64.1 |
| Open PL LLM Leaderboard | 53.22 | Average Score (%) | 64 |
| Open LLM Leaderboard - MuSR | 11.25 | Score | 58.5 |
| Open LLM Leaderboard - BBH | 30.67 | Score | 54.1 |
| Polish EQ-Bench | 54.57 | EQ-Bench Score | 52.5 |
| Open PL LLM - RAG | 56.81 | Average RAG Score (%) | 51 |
| Open LLM Leaderboard - GPQA | 5.7 | Score | 47.8 |
| Open LLM Leaderboard - MATH Level 5 | 8.38 | Score | 42.2 |
| Open LLM Leaderboard - MMLU-Pro | 22.8 | Score | 38.2 |
Interactive version: theaggregate.ai/model?slug=hermes-2-pro-llama-3-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.