mini-magnum-12B-v1.1: benchmark results

intervitens' 12B magnum-series fine-tune of Mistral Nemo Base 2407, designed to replicate the prose quality of Claude 3 Sonnet and Opus. Provider: Other. Released 2024-07-24. Access: Open.

Unified ELO 1503 ± 1, rank #679 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval51.56Score61.5
UGI - Writing34.26Writing Score51.9
Open LLM Leaderboard - BBH29.73Score50.6
Open LLM Leaderboard - MMLU-Pro25.46Score45.8
Open LLM Leaderboard - GPQA5.15Score43.2
Open LLM Leaderboard - MuSR8.09Score37.9
Open LLM Leaderboard - MATH Level 56.19Score33.9
UGI - Willingness (W/10)3.8W/10 Score28.3
UGI - Natural Intelligence16.02NatInt Score23.6
UGI Leaderboard26.67UGI Score22.3

Interactive version: theaggregate.ai/model?slug=mini-magnum-12b-v1-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.