blossom-v5.1-9B — benchmark results

Provider: Other. Released 2024-05-15. Access: Open.

Unified ELO 1275 ± 78, rank #1582 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA11.41Score82.7
Open LLM Leaderboard - MMLU-Pro33.1Score73.3
Open LLM Leaderboard - MATH Level 521.22Score73.1
Open LLM Leaderboard - BBH34.2Score67.6
Open Chinese LLM - TruthfulQA MC55.63Accuracy (%)64.1
Open LLM Leaderboard - IFEval50.86Score60.7
Open LLM Leaderboard - MuSR8.02Score37.6
Open Chinese LLM - WinoGrande57.14Accuracy (%)7.4
Open Chinese LLM - ARC Challenge36.86Accuracy (%)4.5
Open Chinese LLM - HellaSwag41.78Accuracy (%)4.5
Open Chinese LLM Leaderboard33.34Average Score (%)2.1
Open Chinese LLM - GSM8K0Accuracy (%)1.2

Interactive version: theaggregate.ai/model?slug=blossom-v5-1-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.