MS-Meadowlark-22B — benchmark results

Allura-org's roleplay and storywriting merge of Mistral Small Instruct 22B fine-tunes, including SpringDragon and Gutenberg-Doppel components. Provider: Other. Released 2024-10-18. Access: Open.

Unified ELO 1519 ± 36, rank #731 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval66.97Score79.1
Open LLM Leaderboard - GPQA10.07Score78.5
Open LLM Leaderboard - MATH Level 518.35Score68.1
Open LLM Leaderboard - MMLU-Pro31.37Score66.7
UGI - Writing36.57Writing Score60.7
UGI Leaderboard35.73UGI Score54
Open LLM Leaderboard - BBH30.3Score52.8
UGI - Natural Intelligence20.71NatInt Score44.7
UGI - Willingness (W/10)4.8W/10 Score36.1
Open LLM Leaderboard - MuSR5.53Score26.8

Interactive version: theaggregate.ai/model?slug=ms-meadowlark-22b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.