blossom-v5-32B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1529 ± 20, rank #993 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU74.27Accuracy (%) (5-shot)95.9
Open LLM Leaderboard v1 - GSM8K70.66Accuracy (%) (5-shot)93.8
Open LLM Leaderboard - BBH59.55Score81.2
Open LLM Leaderboard v1 - WinoGrande81.69Accuracy (%) (5-shot)80.5
Open LLM Leaderboard - MMLU-Pro42.35Score76.9
Open LLM Leaderboard v1 - TruthfulQA MC258.24MC2 (%) (0-shot)72
Open LLM Leaderboard - GPQA31.12Score68.6
Open LLM Leaderboard - MATH Level 518.66Score68.6
Open LLM Leaderboard v1 - ARC Challenge63.82Normalized accuracy (%) (25-shot)64.4
Open LLM Leaderboard - IFEval52.35Score62.3
Open LLM Leaderboard v1 - HellaSwag83.54Normalized accuracy (%) (10-shot)59.5
Open LLM Leaderboard - MuSR40.2Score43.7

Interactive version: theaggregate.ai/model?slug=blossom-v5-32b · How It Works · Data refreshed daily, snapshot 2026-09-23.