Starling-LM-7B-alpha-ExPO — benchmark results

Provider: UC Berkeley. Released 2024-04-26. Access: Open.

Unified ELO 1361 ± 11, rank #1378 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AlpacaEval 2.019.47LC Win Rate (%)49.1
Open Chinese LLM - GSM8K37.53Accuracy (%)35
Open Chinese LLM - TruthfulQA MC50.86Accuracy (%)23.7
Open Chinese LLM - ARC Challenge46.25Accuracy (%)21.1
Open Chinese LLM Leaderboard49.35Average Score (%)18
Open Chinese LLM - HellaSwag53.32Accuracy (%)14.5
Open Chinese LLM - CMMLU45.53Accuracy (%)13.6
Open Chinese LLM - C-Eval Semantic52.41Accuracy (%)13.4
Open Chinese LLM - WinoGrande59.51Accuracy (%)11.7

Interactive version: theaggregate.ai/model?slug=starling-lm-7b-alpha-expo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.