MiniMA-3B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1259 ± 21, rank #2791 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI45.24Macro F1 (%)27.6
Open Portuguese LLM - BLUEX25.31Accuracy (%)20.8
Open LLM Leaderboard v1 - GSM8K2.73Accuracy (%) (5-shot)20.7
Open LLM Leaderboard v1 - WinoGrande65.98Accuracy (%) (5-shot)19.6
Open LLM Leaderboard v1 - ARC Challenge43.43Normalized accuracy (%) (25-shot)19.3
Open Portuguese LLM - ASSIN2 RTE56.88Macro F1 (%)19.3
Open LLM Leaderboard v1 - HellaSwag68.06Normalized accuracy (%) (10-shot)19
Open Portuguese LLM - ENEM21.2Accuracy (%)16.9
Open Portuguese LLM - OAB Exams25.33Accuracy (%)16.2
Open LLM Leaderboard v1 - MMLU28.69Accuracy (%) (5-shot)16.1
Open LLM Leaderboard v1 - TruthfulQA MC239.76MC2 (%) (0-shot)11.9

Interactive version: theaggregate.ai/model?slug=minima-3b · How It Works · Data refreshed daily, snapshot 2026-09-23.