Hermes 4 405B (Non-reasoning) — benchmark results

Provider: Nous Research. Released 2025-08-26. Access: Open.

Unified ELO 1577 ± 37, rank #541 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Humanities & Social Sciences30Accuracy (%)79.6
AA Omniscience - Law21.7Accuracy (%)77.8
AA Omniscience - Health28.5Accuracy (%)77.6
AA Omniscience - Business24.3Accuracy (%)76.2
AA-Omniscience Accuracy26.27Accuracy (%)72.1
AA Omniscience - Software Engineering (SWE) - Julia24Accuracy (%)70.4
AA Omniscience - Software Engineering (SWE) - Rust56Accuracy (%)64.3
AA Omniscience - Software Engineering (SWE) - Swift44Accuracy (%)63.3
AA Omniscience - Software Engineering (SWE) - Go22Accuracy (%)62.2
AA LiveCodeBench54.6Pass@1 (%)61.5
AA Omniscience-33Score60.9
AA Omniscience - Software Engineering (SWE) - R16Accuracy (%)60.8

Interactive version: theaggregate.ai/model?slug=hermes-4-405b-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.