magnum-v4-9B: benchmark results

Anthracite's community magnum v4 fine-tune of Gemma 2 9B aiming to replicate Claude 3 Sonnet/Opus prose quality. Provider: Other. Released 2024-10-20. Access: Open.

Unified ELO 1545 ± 1, rank #518 of 1553 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard47.93Average Score (%)95.6
Open LLM Leaderboard - GPQA12.98Score87
Open LLM Leaderboard - MuSR15.65Score83.6
Open LLM Leaderboard - MMLU-Pro32.81Score72.6
Open LLM Leaderboard - BBH33.27Score65
Open LLM Leaderboard - MATH Level 513.07Score57.8
Open LLM Leaderboard - IFEval35.03Score33.5

Interactive version: theaggregate.ai/model?slug=magnum-v4-9b · How It Works · Data refreshed daily, snapshot 2026-09-08.