Misted-v2-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1467 ± 20, rank #1580 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC264.13MC2 (%) (0-shot)81.8
Open LLM Leaderboard v1 - HellaSwag85.28Normalized accuracy (%) (10-shot)73.3
Open LLM Leaderboard v1 - ARC Challenge65.27Normalized accuracy (%) (25-shot)69.6
Open Portuguese LLM - ASSIN2 RTE91.13Macro F1 (%)64.1
Open LLM Leaderboard v1 - WinoGrande78.3Accuracy (%) (5-shot)62
Open LLM Leaderboard v1 - GSM8K47.61Accuracy (%) (5-shot)61
Open Portuguese LLM - BLUEX53.82Accuracy (%)57.5
Open LLM Leaderboard v1 - MMLU62.22Accuracy (%) (5-shot)54.5
Open Portuguese LLM - ENEM62.91Accuracy (%)53.8
Open Portuguese LLM - FaQuAD NLI65.89Macro F1 (%)51.4
Open Portuguese LLM - OAB Exams40.91Accuracy (%)45.4

Interactive version: theaggregate.ai/model?slug=misted-v2-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.