stablelm-tuned-alpha-3B: benchmark results

Provider: Stability AI. Released 2023-04-19. Access: Open.

Unified ELO 1198 ± 1, rank #1392 of 1392 rated models, from 72 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ToolBench - WebShop Long0Task Score44.2
MMLU-by-task - Machine Learning31.25Accuracy (%)43.6
MMLU-by-task - TruthfulQA MC242.33Accuracy (%)38.8
MMLU-by-task - Business Ethics35Accuracy (%)34.2
MMLU-by-task - Formal Logic26.19Accuracy (%)32.3
MMLU-by-task - High School World History28.27Accuracy (%)27.9
MMLU-by-task - TruthfulQA MC124.36Accuracy (%)26.9
MMLU-by-task - Medical Genetics30Accuracy (%)25.6
MMLU-by-task - Moral Scenarios24.25Accuracy (%)25.6
ToolBench - WebShop Short0Task Score24.4
MMLU-by-task - College Biology26.39Accuracy (%)23.5
MMLU-by-task - Public Relations29.09Accuracy (%)23.1

Interactive version: theaggregate.ai/model?slug=stablelm-tuned-alpha-3b · How It Works · Data refreshed daily, snapshot 2026-09-05.