magnum-v4-9B — benchmark results

Anthracite's community magnum v4 fine-tune of Gemma 2 9B aiming to replicate Claude 3 Sonnet/Opus prose quality. Provider: Other. Released 2024-10-20. Access: Open.

Unified ELO 1532 ± 67, rank #682 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard748.48Average Score (%)97
Open LLM Leaderboard - GPQA12.98Score87
Open LLM Leaderboard - MuSR15.65Score83.6
Open LLM Leaderboard - MMLU-Pro32.81Score72.7
Open LLM Leaderboard - BBH33.27Score65
Open LLM Leaderboard - MATH Level 513.07Score57.8
Open LLM Leaderboard - IFEval35.03Score33.5

Interactive version: theaggregate.ai/model?slug=magnum-v4-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.