Daredevil-8B: benchmark results

Provider: Other. Released 2024-05-25. Access: Open.

Unified ELO 1512 ± 18, rank #1087 of 2928 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K73.54Accuracy (%) (5-shot)98.8
Open LLM Leaderboard v1 - MMLU69.24Accuracy (%) (5-shot)92.3
Open LLM Leaderboard v1 - ARC Challenge68.86Normalized accuracy (%) (25-shot)81.6
Open LLM Leaderboard v1 - TruthfulQA MC259.89MC2 (%) (0-shot)74.9
Open LLM Leaderboard - MMLU-Pro38.31Score67.3
Open LLM Leaderboard v1 - HellaSwag84.5Normalized accuracy (%) (10-shot)66.5
Open LLM Leaderboard - GPQA30.79Score65.2
Open LLM Leaderboard v1 - WinoGrande78.45Accuracy (%) (5-shot)63.3
Open LLM Leaderboard - BBH51.94Score58.6
YALL Nous Leaderboard54.81Average57.6
Open LLM Leaderboard - IFEval45.48Score50.4
Open LLM Leaderboard - MATH Level 510.65Score49.3

Interactive version: theaggregate.ai/model?slug=daredevil-8b · How It Works · Data refreshed daily, snapshot 2026-09-23.