mini-magnum-12B-v1.1 — benchmark results

intervitens' 12B magnum-series fine-tune of Mistral Nemo Base 2407, designed to replicate the prose quality of Claude 3 Sonnet and Opus. Provider: Other. Released 2024-07-24. Access: Open.

Unified ELO 1455 ± 28, rank #976 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval51.56Score61.5
UGI - Writing34.26Writing Score52.5
Open LLM Leaderboard - BBH29.73Score50.6
Open LLM Leaderboard - MMLU-Pro25.46Score45.9
Open LLM Leaderboard - GPQA5.15Score43.2
Open LLM Leaderboard - MuSR8.09Score37.9
Open LLM Leaderboard - MATH Level 56.19Score33.9
UGI - Willingness (W/10)3.8W/10 Score27.8
UGI - Natural Intelligence16.02NatInt Score23.9
UGI Leaderboard26.67UGI Score22.5

Interactive version: theaggregate.ai/model?slug=mini-magnum-12b-v1-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.