StableBeluga2 — benchmark results

Stable Beluga 2 instruction-tuned model row. Provider: Stability AI. Released 2023-07-27. Access: Open.

Unified ELO 1373 ± 12, rank #1331 of 1776 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Microeconomics81.09Accuracy (%)100
MMLU-by-task - Clinical Knowledge75.85Accuracy (%)99.6
MMLU-by-task - College Mathematics44Accuracy (%)99.5
MMLU-by-task - High School Biology83.23Accuracy (%)99.3
MMLU-by-task - Sociology89.55Accuracy (%)99
MMLU-by-task - Econometrics46.49Accuracy (%)98.9
MMLU-by-task - Moral Scenarios60.78Accuracy (%)98.7
MMLU-by-task - Nutrition77.12Accuracy (%)98.4
MMLU-by-task - Formal Logic50Accuracy (%)98.3
MMLU-by-task - Business Ethics75Accuracy (%)97.9
MMLU-by-task - High School European History84.24Accuracy (%)97.5
MMLU-by-task - ARC Challenge65.96Accuracy (%)97.1

Interactive version: theaggregate.ai/model?slug=stablebeluga2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.