magnum-v4-22B: benchmark results

Anthracite's community magnum v4 fine-tune of Mistral Small Instruct 2409 (22B) aiming to replicate Claude 3 Sonnet/Opus prose quality. Provider: Other. Released 2024-10-20. Access: Open.

Unified ELO 1549 ± 1, rank #443 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA10.4Score79.6
Open LLM Leaderboard - MuSR13.43Score74
Open LLM Leaderboard - BBH35.55Score71.9
Open LLM Leaderboard - MATH Level 520.02Score70.9
Open LLM Leaderboard - IFEval56.29Score68.2
Open LLM Leaderboard - MMLU-Pro31.44Score67.1
UGI - Writing35.22Writing Score55.8
UGI - Natural Intelligence21.94NatInt Score50.9
UGI - Willingness (W/10)4.8W/10 Score36.8
UGI Leaderboard27.33UGI Score24.1

Interactive version: theaggregate.ai/model?slug=magnum-v4-22b · How It Works · Data refreshed daily, snapshot 2026-09-05.