SauerkrautLM-7B-HerO: benchmark results
Provider: VAGOsolutions. Access: Open.
Unified ELO 1461 ± 19, rank #1627 of 2928 rated models, from 12 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 53.46 | Score | 63.8 |
| Open LLM Leaderboard v1 - WinoGrande | 78.37 | Accuracy (%) (5-shot) | 62.7 |
| Open LLM Leaderboard v1 - GSM8K | 49.28 | Accuracy (%) (5-shot) | 62.2 |
| Open LLM Leaderboard v1 - ARC Challenge | 63.23 | Normalized accuracy (%) (25-shot) | 61.9 |
| Open LLM Leaderboard v1 - MMLU | 63.3 | Accuracy (%) (5-shot) | 59.7 |
| Open LLM Leaderboard v1 - HellaSwag | 83.52 | Normalized accuracy (%) (10-shot) | 59.3 |
| Open LLM Leaderboard - BBH | 49.04 | Score | 44.7 |
| Open LLM Leaderboard v1 - TruthfulQA MC2 | 49.22 | MC2 (%) (0-shot) | 44.2 |
| Open LLM Leaderboard - MMLU-Pro | 30.46 | Score | 38 |
| Open LLM Leaderboard - MuSR | 39.24 | Score | 36.7 |
| Open LLM Leaderboard - GPQA | 27.27 | Score | 27.6 |
| Open LLM Leaderboard - MATH Level 5 | 3.93 | Score | 22.6 |
Interactive version: theaggregate.ai/model?slug=sauerkrautlm-7b-hero · How It Works · Data refreshed daily, snapshot 2026-09-23.