magnum-v4-9B — benchmark results
Anthracite's community magnum v4 fine-tune of Gemma 2 9B aiming to replicate Claude 3 Sonnet/Opus prose quality. Provider: Other. Released 2024-10-20. Access: Open.
Unified ELO 1532 ± 67, rank #682 of 1776 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Korean LLM Leaderboard | 748.48 | Average Score (%) | 97 |
| Open LLM Leaderboard - GPQA | 12.98 | Score | 87 |
| Open LLM Leaderboard - MuSR | 15.65 | Score | 83.6 |
| Open LLM Leaderboard - MMLU-Pro | 32.81 | Score | 72.7 |
| Open LLM Leaderboard - BBH | 33.27 | Score | 65 |
| Open LLM Leaderboard - MATH Level 5 | 13.07 | Score | 57.8 |
| Open LLM Leaderboard - IFEval | 35.03 | Score | 33.5 |
Interactive version: theaggregate.ai/model?slug=magnum-v4-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.