Cerebrum-1.0-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1456 ± 19, rank #1672 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI77.1Macro F1 (%)78.6
Open LLM Leaderboard v1 - WinoGrande79.4Accuracy (%) (5-shot)69
Open LLM Leaderboard v1 - HellaSwag84.56Normalized accuracy (%) (10-shot)66.9
Open LLM Leaderboard v1 - MMLU63.56Accuracy (%) (5-shot)61.5
Open Portuguese LLM - OAB Exams44.51Accuracy (%)58.5
Open LLM Leaderboard v1 - GSM8K40.18Accuracy (%) (5-shot)55.4
Open LLM Leaderboard v1 - ARC Challenge61.6Normalized accuracy (%) (25-shot)53.6
Open Portuguese LLM - ENEM61.37Accuracy (%)49.3
Open Portuguese LLM - BLUEX50.63Accuracy (%)47.8
Open Portuguese LLM - ASSIN2 RTE85.63Macro F1 (%)36.7
Open LLM Leaderboard v1 - TruthfulQA MC246.49MC2 (%) (0-shot)34.6
YALL Nous Leaderboard48.2Average29.1

Interactive version: theaggregate.ai/model?slug=cerebrum-1-0-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.