MiniChat-3B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1319 ± 20, rank #2626 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC245.67MC2 (%) (0-shot)31.8
Open LLM Leaderboard v1 - GSM8K10.54Accuracy (%) (5-shot)31.5
Open LLM Leaderboard v1 - MMLU39.17Accuracy (%) (5-shot)20.7
Open LLM Leaderboard v1 - ARC Challenge44.03Normalized accuracy (%) (25-shot)19.8
Open LLM Leaderboard v1 - WinoGrande65.27Accuracy (%) (5-shot)18.5
Open LLM Leaderboard v1 - HellaSwag67.19Normalized accuracy (%) (10-shot)18.3
Open Portuguese LLM - FaQuAD NLI0Macro F1 (%)1
Open Portuguese LLM - ASSIN2 RTE0Macro F1 (%)0.9
Open Portuguese LLM - OAB Exams0Accuracy (%)0.9
Open Portuguese LLM - ENEM0Accuracy (%)0.8
Open Portuguese LLM - BLUEX0Accuracy (%)0.7

Interactive version: theaggregate.ai/model?slug=minichat-3b · How It Works · Data refreshed daily, snapshot 2026-09-23.