magnum-v4-9B: benchmark results
Anthracite's community magnum v4 fine-tune of Gemma 2 9B aiming to replicate Claude 3 Sonnet/Opus prose quality. Provider: Other. Released 2024-10-20. Access: Open.
Unified ELO 1545 ± 1, rank #518 of 1553 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Korean LLM Leaderboard | 47.93 | Average Score (%) | 95.6 |
| Open LLM Leaderboard - GPQA | 12.98 | Score | 87 |
| Open LLM Leaderboard - MuSR | 15.65 | Score | 83.6 |
| Open LLM Leaderboard - MMLU-Pro | 32.81 | Score | 72.6 |
| Open LLM Leaderboard - BBH | 33.27 | Score | 65 |
| Open LLM Leaderboard - MATH Level 5 | 13.07 | Score | 57.8 |
| Open LLM Leaderboard - IFEval | 35.03 | Score | 33.5 |
Interactive version: theaggregate.ai/model?slug=magnum-v4-9b · How It Works · Data refreshed daily, snapshot 2026-09-08.