Mistral-Small-24B-Base-2501 — benchmark results

Mistral's 24B Apache-2.0 pretrained base behind Mistral Small 3, a knowledge-dense small model with a 32K context. Provider: Mistral. Released 2025-01-23. Access: Open.

Unified ELO 1456 ± 77, rank #968 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA18.34Score96.8
Open LLM Leaderboard - MMLU-Pro48.96Score96.7
Open LLM Leaderboard - BBH48.54Score88.8
Greek MMLU - Humanities74.07Accuracy (%)81.5
Greek MMLU70.66Accuracy (%)79
Open PL LLM - RAG69.99Average RAG Score (%)78.3
Open PL LLM - Generative64.84Average Generative Score (%)78
Greek MMLU - Other67.56Accuracy (%)77.8
Greek MMLU - STEM67.6Accuracy (%)76.5
Greek MMLU - Social Sciences73.55Accuracy (%)76.5
Open PL LLM Leaderboard59.9Average Score (%)75.9
Greek MMLU - Greek-Specific75.98Accuracy (%)74.1

Interactive version: theaggregate.ai/model?slug=mistral-small-24b-base-2501 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.