smol_llama-220M-openhermes: benchmark results

Provider: Other. Access: Open.

Unified ELO 1212 ± 20, rank #2882 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR38.47Score32.3
Open LLM Leaderboard v1 - TruthfulQA MC243.08MC2 (%) (0-shot)22.4
Open LLM Leaderboard - GPQA26.76Score22.1
Open LLM Leaderboard v1 - GSM8K0.61Accuracy (%) (5-shot)13.2
Open LLM Leaderboard v1 - MMLU26.17Accuracy (%) (5-shot)11.6
Open LLM Leaderboard - MATH Level 51.06Score7.6
Open LLM Leaderboard v1 - WinoGrande52.01Accuracy (%) (5-shot)6.4
Open LLM Leaderboard - BBH30.28Score5.7
Open LLM Leaderboard - IFEval15.55Score5.7
Open LLM Leaderboard v1 - HellaSwag28.98Normalized accuracy (%) (10-shot)5.1
Open LLM Leaderboard v1 - ARC Challenge25.17Normalized accuracy (%) (25-shot)4.5
Open LLM Leaderboard - MMLU-Pro11.2Score3.3

Interactive version: theaggregate.ai/model?slug=smol-llama-220m-openhermes · How It Works · Data refreshed daily, snapshot 2026-09-23.