magnum-v3-9B-chatml: benchmark results

Provider: Other. Access: Open.

Unified ELO 1515 ± 59, rank #1006 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ENEM74.39Accuracy (%)86.9
Open LLM Leaderboard - GPQA34.56Score86.3
Open Portuguese LLM - BLUEX65.23Accuracy (%)86.2
Open Portuguese LLM - OAB Exams54.4Accuracy (%)86.1
Open LLM Leaderboard - MuSR44.32Score79.8
Open LLM Leaderboard - MMLU-Pro42.42Score77.1
Open LLM Leaderboard - BBH54.28Score70.1
Open Portuguese LLM - ASSIN2 RTE87.88Macro F1 (%)42.5
Open LLM Leaderboard - MATH Level 56.95Score37.2
Open Portuguese LLM - FaQuAD NLI51.29Macro F1 (%)32.8
Open LLM Leaderboard - IFEval12.75Score2.9

Interactive version: theaggregate.ai/model?slug=magnum-v3-9b-chatml · How It Works · Data refreshed daily, snapshot 2026-09-19.