ALMA-7B-R: benchmark results

Provider: Other. Access: Open.

Unified ELO 1283 ± 34, rank #2502 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI44.42Macro F1 (%)25.3
Open Portuguese LLM - OAB Exams29.16Accuracy (%)24.7
Open Portuguese LLM - ASSIN2 RTE60Macro F1 (%)21
Open Portuguese LLM - BLUEX24.62Accuracy (%)19.1
Open Portuguese LLM - ENEM22.46Accuracy (%)18.9
Open Chinese LLM - WinoGrande59.91Accuracy (%)12.9
Open Chinese LLM - HellaSwag48.55Accuracy (%)5.9
Open Chinese LLM - ARC Challenge38.91Accuracy (%)5.6
Open Chinese LLM - GSM8K4.02Accuracy (%)5
Open Chinese LLM Leaderboard36.37Average Score (%)4.2
Open Chinese LLM - C-Eval Semantic29.64Accuracy (%)2.4
Open Chinese LLM - CMMLU30.15Accuracy (%)2.4

Interactive version: theaggregate.ai/model?slug=alma-7b-r · How It Works · Data refreshed daily, snapshot 2026-09-19.