Starling-LM-7B-alpha: benchmark results

Provider: UC Berkeley. Released 2023-11-25. Access: Open.

Unified ELO 1437 ± 1, rank #1000 of 1392 rated models, from 40 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard40.8Average Score (%)76.1
Open PL LLM - Multiple Choice51.16Average Multiple-Choice Score (%)69.2
Open PL LLM - RAG65.73Average RAG Score (%)67.5
Open PL LLM Leaderboard54.23Average Score (%)66.4
Open LLM Leaderboard - IFEval54.8Score66.1
Open PL LLM - Generative56.6Average Generative Score (%)63.6
BiGGen-Bench3.54Average Score (1-5)62.7
MT-Bench PL - STEM8.85Judge Score (0-10)55.1
Open LLM Leaderboard - GPQA6.26Score52.6
Open LLM Leaderboard - MuSR9.5Score46.3
BenchBench42.73Aggregate Score (%)43.4
MT-Bench PL - Coding4.75Judge Score (0-10)42.9

Interactive version: theaggregate.ai/model?slug=starling-lm-7b-alpha · How It Works · Data refreshed daily, snapshot 2026-09-05.