StableLM Tuned Alpha 7B — benchmark results

Provider: Stability AI. Released 2023-04-25. Access: Open.

Unified ELO 1116 ± 19, rank #1756 of 1776 rated models, from 79 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Physics25.49Accuracy (%)53.1
ToolBench - WebShop Long0Task Score44.2
MMLU-by-task - High School Statistics35.19Accuracy (%)42.3
MMLU-by-task - College Mathematics30Accuracy (%)38.1
MMLU-by-task - College Chemistry28Accuracy (%)35
MMLU-by-task - High School Mathematics25.93Accuracy (%)34
MMLU-by-task - Human Sexuality29.01Accuracy (%)31.1
MMLU-by-task - Human Aging35.43Accuracy (%)30.1
MMLU-by-task - High School World History28.69Accuracy (%)29.4
MMLU-by-task - TruthfulQA MC240.37Accuracy (%)28.7
MMLU-by-task - Conceptual Physics31.49Accuracy (%)28.4
MMLU-by-task - Jurisprudence28.7Accuracy (%)27.2

Interactive version: theaggregate.ai/model?slug=stablelm-tuned-alpha-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.