TinyMistral-248M-v2.5: benchmark results

Provider: Other. Access: Open.

Unified ELO 1192 ± 20, rank #2910 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC246.72MC2 (%) (0-shot)35.3
Open LLM Leaderboard - MuSR37.82Score28.7
Open LLM Leaderboard - MATH Level 50.98Score7
Open LLM Leaderboard - BBH30.39Score6.1
Open LLM Leaderboard - GPQA25.08Score5.5
Open LLM Leaderboard - MMLU-Pro11.35Score5.3
Open LLM Leaderboard v1 - GSM8K0Accuracy (%) (5-shot)4.6
Open LLM Leaderboard v1 - HellaSwag27.49Normalized accuracy (%) (10-shot)4.2
Open LLM Leaderboard v1 - ARC Challenge24.57Normalized accuracy (%) (25-shot)3.8
Open LLM Leaderboard - IFEval13.36Score3.3
Open LLM Leaderboard v1 - MMLU23.15Accuracy (%) (5-shot)1.7
Open LLM Leaderboard v1 - WinoGrande47.83Accuracy (%) (5-shot)0.1

Interactive version: theaggregate.ai/model?slug=tinymistral-248m-v2-5 · How It Works · Data refreshed daily, snapshot 2026-09-23.