llamaRAGdrama: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1420 ± 58, rank #1749 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ASSIN2 RTE92.24Macro F1 (%)76.6
Open LLM Leaderboard - MuSR43.16Score71.7
Open Portuguese LLM - FaQuAD NLI73.42Macro F1 (%)69
Open Portuguese LLM - BLUEX54.66Accuracy (%)60.9
Open Portuguese LLM - ENEM62.98Accuracy (%)54.1
Open Portuguese LLM - OAB Exams42.73Accuracy (%)53.1
Open LLM Leaderboard - MMLU-Pro27.24Score29.3
Open LLM Leaderboard - MATH Level 54.31Score24.6
Open LLM Leaderboard - BBH40.07Score24.4
Open LLM Leaderboard - IFEval25.98Score22.8
Open LLM Leaderboard - GPQA26.43Score18.3

Interactive version: theaggregate.ai/model?slug=llamaragdrama · How It Works · Data refreshed daily, snapshot 2026-09-19.