MiniMA-2-3B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1324 ± 20, rank #2602 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K8.11Accuracy (%) (5-shot)28.1
Open Portuguese LLM - BLUEX30.18Accuracy (%)26
Open Portuguese LLM - OAB Exams27.93Accuracy (%)23.1
Open Portuguese LLM - ENEM27.99Accuracy (%)22.8
Open LLM Leaderboard v1 - MMLU41.22Accuracy (%) (5-shot)21.6
Open LLM Leaderboard v1 - WinoGrande66.69Accuracy (%) (5-shot)20.6
Open LLM Leaderboard v1 - ARC Challenge44.71Normalized accuracy (%) (25-shot)20.3
Open LLM Leaderboard v1 - HellaSwag69.33Normalized accuracy (%) (10-shot)20
Open Portuguese LLM - ASSIN2 RTE36.5Macro F1 (%)10.5
Open LLM Leaderboard v1 - TruthfulQA MC238.44MC2 (%) (0-shot)8.1
Open Portuguese LLM - FaQuAD NLI33.43Macro F1 (%)5.9

Interactive version: theaggregate.ai/model?slug=minima-2-3b · How It Works · Data refreshed daily, snapshot 2026-09-23.