Loyal-Macaroni-Maid-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1491 ± 20, rank #1346 of 2928 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K68.46Accuracy (%) (5-shot)86
Open LLM Leaderboard v1 - HellaSwag86.39Normalized accuracy (%) (10-shot)80.7
Open LLM Leaderboard v1 - TruthfulQA MC262.5MC2 (%) (0-shot)79.3
Open LLM Leaderboard v1 - ARC Challenge68Normalized accuracy (%) (25-shot)78.9
Open LLM Leaderboard v1 - MMLU64.87Accuracy (%) (5-shot)77.7
Open LLM Leaderboard v1 - WinoGrande79.87Accuracy (%) (5-shot)71.4
UGI - Willingness (W/10)6.2W/10 Score58.3
UGI Leaderboard32.78UGI Score41.7
UGI - Writing21.64Writing Score16.1
UGI - Natural Intelligence13.54NatInt Score13

Interactive version: theaggregate.ai/model?slug=loyal-macaroni-maid-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.