blossom-v5-llama3-8B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1461 ± 20, rank #1628 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU65.48Accuracy (%) (5-shot)84.5
Open LLM Leaderboard v1 - TruthfulQA MC257.12MC2 (%) (0-shot)69.4
Open LLM Leaderboard v1 - WinoGrande78.37Accuracy (%) (5-shot)62.7
Open LLM Leaderboard v1 - GSM8K44.43Accuracy (%) (5-shot)58.5
Open LLM Leaderboard v1 - HellaSwag83.05Normalized accuracy (%) (10-shot)55.7
Open LLM Leaderboard - IFEval43.43Score45.9
Open LLM Leaderboard v1 - ARC Challenge56.83Normalized accuracy (%) (25-shot)36.2
Open LLM Leaderboard - MATH Level 55.14Score28.7
Open LLM Leaderboard - BBH41.85Score27.3
Open LLM Leaderboard - MMLU-Pro22.06Score23
Open LLM Leaderboard - MuSR36.7Score22
Open LLM Leaderboard - GPQA26.51Score19.3

Interactive version: theaggregate.ai/model?slug=blossom-v5-llama3-8b · How It Works · Data refreshed daily, snapshot 2026-09-23.