ALMA-13B-Pretrain: benchmark results

Provider: Other. Access: Open.

Unified ELO 1345 ± 33, rank #2262 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande61.8Accuracy (%)31.9
Open Portuguese LLM - ENEM45.7Accuracy (%)31.9
Open Portuguese LLM - BLUEX37.27Accuracy (%)30.7
Open Portuguese LLM - OAB Exams33.17Accuracy (%)30
Open Portuguese LLM - ASSIN2 RTE78.75Macro F1 (%)29.7
Open Chinese LLM - HellaSwag54.47Accuracy (%)21.4
Open Chinese LLM - ARC Challenge44.62Accuracy (%)14.8
Open Chinese LLM - TruthfulQA MC47.39Accuracy (%)10.2
Open Chinese LLM - GSM8K9.48Accuracy (%)8.9
Open Portuguese LLM - FaQuAD NLI43.92Macro F1 (%)8.9
Open Chinese LLM Leaderboard41.71Average Score (%)5.9
Open Chinese LLM - C-Eval Semantic36.8Accuracy (%)4.7

Interactive version: theaggregate.ai/model?slug=alma-13b-pretrain · How It Works · Data refreshed daily, snapshot 2026-09-19.