Hercules-3.1-Mistral-7B: benchmark results

Provider: Other. Released 2024-02-01. Access: Open.

Unified ELO 1455 ± 14, rank #1679 of 2928 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Medical LLM - PubMedQA75.6Accuracy (%)75.6
Open LLM Leaderboard v1 - WinoGrande79.01Accuracy (%) (5-shot)66.8
Open LLM Leaderboard v1 - MMLU63.65Accuracy (%) (5-shot)62.2
Open LLM Leaderboard v1 - HellaSwag83.55Normalized accuracy (%) (10-shot)59.6
Open LLM Leaderboard v1 - GSM8K42.3Accuracy (%) (5-shot)57.1
Open LLM Leaderboard v1 - ARC Challenge61.18Normalized accuracy (%) (25-shot)51.6
Open Medical LLM - MMLU College Medicine61.85Accuracy (%)48
Open Medical LLM - MMLU Professional Medicine68.38Accuracy (%)44.9
Open Medical LLM - MMLU College Biology71.53Accuracy (%)40.9
Open Medical LLM - MedMCQA48.53Accuracy (%)40.9
Open Medical LLM - MedQA (USMLE)51.22Accuracy (%)37.5
Open Medical LLM63.09Average Accuracy (%)36.9

Interactive version: theaggregate.ai/model?slug=hercules-3-1-mistral-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.