speechless-instruct-mistral-7B-v0.2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1458 ± 19, rank #1655 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR49.02Score97
Open LLM Leaderboard v1 - GSM8K56.33Accuracy (%) (5-shot)68
Open LLM Leaderboard v1 - WinoGrande78.22Accuracy (%) (5-shot)61.5
Open LLM Leaderboard v1 - MMLU61.27Accuracy (%) (5-shot)51.3
Open LLM Leaderboard v1 - HellaSwag81.89Normalized accuracy (%) (10-shot)47.6
Open LLM Leaderboard v1 - TruthfulQA MC249.85MC2 (%) (0-shot)46.2
Open LLM Leaderboard v1 - ARC Challenge58.79Normalized accuracy (%) (25-shot)40.9
Open LLM Leaderboard - GPQA28.19Score36.8
Open LLM Leaderboard - BBH46.07Score36.2
Open LLM Leaderboard - MMLU-Pro29.02Score33.5
Open LLM Leaderboard - IFEval32.61Score30.5
Open LLM Leaderboard - MATH Level 54.91Score27.6

Interactive version: theaggregate.ai/model?slug=speechless-instruct-mistral-7b-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-23.