ALMA-13B-R — benchmark results

Provider: Other. Released 2024-01-17. Access: Open.

Unified ELO 1173 ± 72, rank #1716 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande61.25Accuracy (%)25.1
Open LLM Leaderboard - MMLU-Pro9.08Score19.8
Open LLM Leaderboard - BBH8.82Score18.6
Open Chinese LLM - HellaSwag53.64Accuracy (%)16.3
Open LLM Leaderboard - MATH Level 51.74Score12.5
Open Chinese LLM - ARC Challenge43.17Accuracy (%)11.3
Open LLM Leaderboard - MuSR2.23Score9.8
Open LLM Leaderboard - GPQA1.01Score9.7
Open Chinese LLM - GSM8K8.72Accuracy (%)7.9
Open Chinese LLM Leaderboard40.57Average Score (%)5
Open Chinese LLM - CMMLU37.69Accuracy (%)4.7
Open Chinese LLM - C-Eval Semantic35.22Accuracy (%)4.2

Interactive version: theaggregate.ai/model?slug=alma-13b-r · How the rankings work · Data refreshed daily, snapshot 2026-07-22.