SauerkrautLM-7B-HerO: benchmark results

Provider: VAGOsolutions. Access: Open.

Unified ELO 1461 ± 19, rank #1627 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval53.46Score63.8
Open LLM Leaderboard v1 - WinoGrande78.37Accuracy (%) (5-shot)62.7
Open LLM Leaderboard v1 - GSM8K49.28Accuracy (%) (5-shot)62.2
Open LLM Leaderboard v1 - ARC Challenge63.23Normalized accuracy (%) (25-shot)61.9
Open LLM Leaderboard v1 - MMLU63.3Accuracy (%) (5-shot)59.7
Open LLM Leaderboard v1 - HellaSwag83.52Normalized accuracy (%) (10-shot)59.3
Open LLM Leaderboard - BBH49.04Score44.7
Open LLM Leaderboard v1 - TruthfulQA MC249.22MC2 (%) (0-shot)44.2
Open LLM Leaderboard - MMLU-Pro30.46Score38
Open LLM Leaderboard - MuSR39.24Score36.7
Open LLM Leaderboard - GPQA27.27Score27.6
Open LLM Leaderboard - MATH Level 53.93Score22.6

Interactive version: theaggregate.ai/model?slug=sauerkrautlm-7b-hero · How It Works · Data refreshed daily, snapshot 2026-09-23.