distilgpt2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1200 ± 20, rank #2899 of 2928 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AI Energy Score (Text Generation)5Energy Score (1-5)79.5
Open LLM Leaderboard - MuSR42.07Score61.4
Open LLM Leaderboard v1 - TruthfulQA MC244.49MC2 (%) (0-shot)27.3
Open LLM Leaderboard - GPQA25.92Score11.8
Open LLM Leaderboard - MMLU-Pro11.87Score9.2
Open LLM Leaderboard v1 - WinoGrande53.12Accuracy (%) (5-shot)7.4
Open LLM Leaderboard - BBH30.38Score6.1
Open LLM Leaderboard v1 - MMLU24.81Accuracy (%) (5-shot)5.2
Open LLM Leaderboard - MATH Level 50.6Score5
Open LLM Leaderboard v1 - GSM8K0Accuracy (%) (5-shot)4.6
Open LLM Leaderboard v1 - HellaSwag27.58Normalized accuracy (%) (10-shot)4.3
Open LLM Leaderboard - IFEval6.11Score1.1

Interactive version: theaggregate.ai/model?slug=distilgpt2 · How It Works · Data refreshed daily, snapshot 2026-09-23.