LL7M: benchmark results

Provider: Other. Access: Open.

Unified ELO 1274 ± 21, rank #2770 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI51.12Macro F1 (%)32.6
Open Portuguese LLM - ASSIN2 RTE65.68Macro F1 (%)23
Open LLM Leaderboard v1 - ARC Challenge44.97Normalized accuracy (%) (25-shot)20.6
Open LLM Leaderboard v1 - HellaSwag68.81Normalized accuracy (%) (10-shot)19.6
Open Portuguese LLM - ENEM22.81Accuracy (%)19.2
Open LLM Leaderboard v1 - MMLU34.44Accuracy (%) (5-shot)18.1
Open LLM Leaderboard v1 - TruthfulQA MC241.39MC2 (%) (0-shot)16.9
Open LLM Leaderboard v1 - WinoGrande64.09Accuracy (%) (5-shot)16.9
Open LLM Leaderboard v1 - GSM8K0.61Accuracy (%) (5-shot)13.2
Open Portuguese LLM - OAB Exams24.46Accuracy (%)13
Open Portuguese LLM - BLUEX21.28Accuracy (%)11.8

Interactive version: theaggregate.ai/model?slug=ll7m · How It Works · Data refreshed daily, snapshot 2026-09-23.