MS-Meadowlark-22B: benchmark results

Allura-org's roleplay and storywriting merge of Mistral Small Instruct 22B fine-tunes, including SpringDragon and Gutenberg-Doppel components. Provider: Other. Released 2024-10-18. Access: Open.

Unified ELO 1541 ± 1, rank #479 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval66.97Score79.1
Open LLM Leaderboard - GPQA10.07Score78.4
Open LLM Leaderboard - MATH Level 518.35Score68.1
Open LLM Leaderboard - MMLU-Pro31.37Score66.6
UGI - Writing36.57Writing Score60.1
UGI Leaderboard35.73UGI Score53.6
Open LLM Leaderboard - BBH30.3Score52.8
UGI - Natural Intelligence20.71NatInt Score44.2
UGI - Willingness (W/10)4.8W/10 Score36.8
Open LLM Leaderboard - MuSR5.53Score26.8

Interactive version: theaggregate.ai/model?slug=ms-meadowlark-22b · How It Works · Data refreshed daily, snapshot 2026-09-05.