Yarn-Mistral-7B-64k: benchmark results

Provider: Other. Access: Open.

Unified ELO 1449 ± 19, rank #1743 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU62.96Accuracy (%) (5-shot)57.7
Open LLM Leaderboard v1 - WinoGrande77.27Accuracy (%) (5-shot)54.6
Open LLM Leaderboard - MuSR41.24Score52.5
Open LLM Leaderboard v1 - HellaSwag82.51Normalized accuracy (%) (10-shot)51.9
Open LLM Leaderboard v1 - GSM8K33.28Accuracy (%) (5-shot)49.4
Open LLM Leaderboard v1 - ARC Challenge59.9Normalized accuracy (%) (25-shot)45.4
Open LLM Leaderboard - GPQA29.03Score45
Open LLM Leaderboard - MMLU-Pro29.14Score33.8
Open LLM Leaderboard - BBH42.93Score29.4
Open LLM Leaderboard - MATH Level 53.7Score21.5
Open LLM Leaderboard v1 - TruthfulQA MC241.86MC2 (%) (0-shot)18.6
Open LLM Leaderboard - IFEval20.8Score13.2

Interactive version: theaggregate.ai/model?slug=yarn-mistral-7b-64k · How It Works · Data refreshed daily, snapshot 2026-09-23.