Pantheon-RP-1.0-8B-Llama-3: benchmark results

Provider: Other. Access: Open.

Unified ELO 1471 ± 19, rank #1551 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU66.44Accuracy (%) (5-shot)87.2
Open LLM Leaderboard v1 - GSM8K50.72Accuracy (%) (5-shot)63.1
Open LLM Leaderboard v1 - HellaSwag83.89Normalized accuracy (%) (10-shot)62.3
Open LLM Leaderboard v1 - TruthfulQA MC253.83MC2 (%) (0-shot)60.8
Open LLM Leaderboard v1 - WinoGrande77.03Accuracy (%) (5-shot)52.7
Open LLM Leaderboard v1 - ARC Challenge59.9Normalized accuracy (%) (25-shot)45.4
Open LLM Leaderboard - IFEval39.33Score39.1
Open LLM Leaderboard - MMLU-Pro30.67Score38.8
Open LLM Leaderboard - BBH45.39Score35.1
Open LLM Leaderboard - MATH Level 56.34Score34.6
Open LLM Leaderboard - MuSR38.32Score31.2
Open LLM Leaderboard - GPQA27.6Score31.1

Interactive version: theaggregate.ai/model?slug=pantheon-rp-1-0-8b-llama-3 · How It Works · Data refreshed daily, snapshot 2026-09-23.