StableLM Tuned Alpha 7B: benchmark results

Provider: Stability AI. Released 2023-04-25. Access: Open.

Unified ELO 1210 ± 1, rank #1390 of 1392 rated models, from 86 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Physics25.49Accuracy (%)53.1
ToolBench - WebShop Long0Task Score44.2
MMLU-by-task - High School Statistics35.19Accuracy (%)42.3
MMLU-by-task - College Mathematics30Accuracy (%)38.1
MMLU-by-task - College Chemistry28Accuracy (%)35
MMLU-by-task - High School Mathematics25.93Accuracy (%)34
MMLU-by-task - Human Sexuality29.01Accuracy (%)31.1
MMLU-by-task - Human Aging35.43Accuracy (%)30.1
MMLU-by-task - High School World History28.69Accuracy (%)29.4
MMLU-by-task - TruthfulQA MC240.37Accuracy (%)28.7
MMLU-by-task - Conceptual Physics31.49Accuracy (%)28.4
MMLU-by-task - Jurisprudence28.7Accuracy (%)27.2

Interactive version: theaggregate.ai/model?slug=stablelm-tuned-alpha-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.