Mistral-portuguese-luana-7B: benchmark results

Provider: Mistral. Access: Open.

Unified ELO 1452 ± 20, rank #1711 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC259.35MC2 (%) (0-shot)73.7
Open Portuguese LLM - ASSIN2 RTE90.63Macro F1 (%)59.2
Open LLM Leaderboard v1 - WinoGrande77.74Accuracy (%) (5-shot)58.2
Open LLM Leaderboard v1 - GSM8K38.82Accuracy (%) (5-shot)53.7
Open LLM Leaderboard v1 - HellaSwag82.57Normalized accuracy (%) (10-shot)52.4
Open LLM Leaderboard v1 - MMLU61.15Accuracy (%) (5-shot)50.9
Open LLM Leaderboard v1 - ARC Challenge60.24Normalized accuracy (%) (25-shot)46.9
Open Portuguese LLM - ENEM58.64Accuracy (%)44.2
Open Portuguese LLM - FaQuAD NLI57.79Macro F1 (%)41.3
Open Portuguese LLM - BLUEX47.98Accuracy (%)40.7
Open Portuguese LLM - OAB Exams38.82Accuracy (%)39.5

Interactive version: theaggregate.ai/model?slug=mistral-portuguese-luana-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.