NeuralWestSeverus-7B-slerp: benchmark results

Provider: Other. Access: Open.

Unified ELO 1503 ± 20, rank #1178 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K72.78Accuracy (%) (5-shot)98.1
Open LLM Leaderboard v1 - ARC Challenge71.5Normalized accuracy (%) (25-shot)89.5
Open LLM Leaderboard v1 - TruthfulQA MC269.32MC2 (%) (0-shot)88.8
Open LLM Leaderboard v1 - HellaSwag87.92Normalized accuracy (%) (10-shot)88.7
Open LLM Leaderboard v1 - WinoGrande83.27Accuracy (%) (5-shot)87.9
Open LLM Leaderboard - MuSR45.29Score84.9
Open LLM Leaderboard v1 - MMLU65.01Accuracy (%) (5-shot)80.2
Open LLM Leaderboard - BBH52.44Score61.4
Open LLM Leaderboard - IFEval41.36Score41.9
Open LLM Leaderboard - MMLU-Pro31.37Score41.5
Open LLM Leaderboard - MATH Level 57.33Score38.6
Open LLM Leaderboard - GPQA27.1Score25.8

Interactive version: theaggregate.ai/model?slug=neuralwestseverus-7b-slerp · How It Works · Data refreshed daily, snapshot 2026-09-23.