stablelm-tuned-alpha-3B — benchmark results

Provider: Stability AI. Released 2023-04-19. Access: Open.

Unified ELO 1089 ± 22, rank #1764 of 1776 rated models, from 72 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ToolBench - WebShop Long0Task Score44.2
MMLU-by-task - Machine Learning31.25Accuracy (%)43.6
MMLU-by-task - TruthfulQA MC242.33Accuracy (%)38.8
MMLU-by-task - Business Ethics35Accuracy (%)34.2
MMLU-by-task - Formal Logic26.19Accuracy (%)32.3
MMLU-by-task - High School World History28.27Accuracy (%)27.9
MMLU-by-task - TruthfulQA MC124.36Accuracy (%)26.9
MMLU-by-task - Medical Genetics30Accuracy (%)25.6
MMLU-by-task - Moral Scenarios24.25Accuracy (%)25.6
ToolBench - WebShop Short0Task Score24.4
MMLU-by-task - College Biology26.39Accuracy (%)23.5
MMLU-by-task - Public Relations29.09Accuracy (%)23.1

Interactive version: theaggregate.ai/model?slug=stablelm-tuned-alpha-3b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.