flammen15-gutenberg-DPO-v1-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1501 ± 20, rank #1204 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K71.34Accuracy (%) (5-shot)95.7
Open LLM Leaderboard v1 - TruthfulQA MC271.98MC2 (%) (0-shot)92.9
Open LLM Leaderboard v1 - HellaSwag88.37Normalized accuracy (%) (10-shot)91.3
Open LLM Leaderboard v1 - ARC Challenge71.5Normalized accuracy (%) (25-shot)89.5
Open LLM Leaderboard v1 - WinoGrande82.56Accuracy (%) (5-shot)84.6
Open LLM Leaderboard v1 - MMLU64.87Accuracy (%) (5-shot)77.7
Open LLM Leaderboard - MuSR42.93Score69.9
Open LLM Leaderboard - BBH52.03Score59.2
Open LLM Leaderboard - IFEval47.98Score55.8
Open LLM Leaderboard - MMLU-Pro31.86Score43.4
Open LLM Leaderboard - MATH Level 57.63Score39.6
Open LLM Leaderboard - GPQA28.44Score39.4

Interactive version: theaggregate.ai/model?slug=flammen15-gutenberg-dpo-v1-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.