Mistral-portuguese-luana-7B-chat: benchmark results

Provider: Mistral. Access: Open.

Unified ELO 1447 ± 20, rank #1755 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC254.6MC2 (%) (0-shot)63
Open Portuguese LLM - ASSIN2 RTE90.47Macro F1 (%)57.9
Open LLM Leaderboard v1 - GSM8K38.21Accuracy (%) (5-shot)53.3
Open Portuguese LLM - FaQuAD NLI66.75Macro F1 (%)52.8
Open LLM Leaderboard v1 - MMLU60.84Accuracy (%) (5-shot)49.9
Open LLM Leaderboard v1 - WinoGrande76.24Accuracy (%) (5-shot)47
Open LLM Leaderboard v1 - HellaSwag81.4Normalized accuracy (%) (10-shot)45
Open Portuguese LLM - ENEM59.13Accuracy (%)44.9
Open Portuguese LLM - BLUEX49.24Accuracy (%)44.4
Open LLM Leaderboard v1 - ARC Challenge59.3Normalized accuracy (%) (25-shot)42.8
Open Portuguese LLM - OAB Exams36.58Accuracy (%)34.4

Interactive version: theaggregate.ai/model?slug=mistral-portuguese-luana-7b-chat · How It Works · Data refreshed daily, snapshot 2026-09-23.