Starling-LM-7B-alpha — benchmark results

Provider: UC Berkeley. Released 2023-11-25. Access: Open.

Unified ELO 1376 ± 13, rank #1323 of 1776 rated models, from 27 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard411.87Average Score (%)78.5
Open PL LLM - Multiple Choice51.16Average Multiple-Choice Score (%)69.2
Open PL LLM - RAG65.73Average RAG Score (%)67.5
Open PL LLM Leaderboard54.23Average Score (%)66.4
Open LLM Leaderboard - IFEval54.8Score66.1
Open PL LLM - Generative56.6Average Generative Score (%)63.6
BiGGen-Bench3.54Average Score (1-5)62.7
MT-Bench PL - STEM8.85Judge Score (0-10)55.1
Open LLM Leaderboard - GPQA6.26Score52.5
Open LLM Leaderboard - MuSR9.5Score46.3
BenchBench42.73Aggregate Score (%)43.4
MT-Bench PL - Coding4.75Judge Score (0-10)42.9

Interactive version: theaggregate.ai/model?slug=starling-lm-7b-alpha · How the rankings work · Data refreshed daily, snapshot 2026-07-22.