canarim-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1337 ± 21, rank #2556 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI49.09Macro F1 (%)31.4
Open LLM Leaderboard v1 - HellaSwag77.52Normalized accuracy (%) (10-shot)31.1
Open LLM Leaderboard v1 - GSM8K9.93Accuracy (%) (5-shot)30.9
Open Portuguese LLM - OAB Exams31.48Accuracy (%)28.3
Open LLM Leaderboard v1 - WinoGrande71.43Accuracy (%) (5-shot)26.6
Open LLM Leaderboard v1 - ARC Challenge51.96Normalized accuracy (%) (25-shot)26.5
Open Portuguese LLM - ASSIN2 RTE71.96Macro F1 (%)26
Open Portuguese LLM - BLUEX29.76Accuracy (%)25.6
Open Portuguese LLM - ENEM25.96Accuracy (%)21.5
Open LLM Leaderboard v1 - MMLU40.92Accuracy (%) (5-shot)21.4
Open LLM Leaderboard v1 - TruthfulQA MC240.03MC2 (%) (0-shot)12.8

Interactive version: theaggregate.ai/model?slug=canarim-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.