romulus-mistral-nemo-12B-simpo: benchmark results

Axolotl AI's SimPO preference-optimization fine-tune of Mistral Nemo 12B, trained on Princeton's gemma2-ultrafeedback-armorm pairs. Provider: Other. Released 2024-07-24. Access: Open.

Unified ELO 1566 ± 1, rank #427 of 1553 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard52.29Average Score (%)99
Open LLM Leaderboard - IFEval60.79Score72.8
Open LLM Leaderboard - MuSR12.98Score71.3
Open LLM Leaderboard - BBH34.64Score69
Open LLM Leaderboard - MATH Level 511.4Score51.8
Open LLM Leaderboard - MMLU-Pro27.43Score50.4
Open LLM Leaderboard - GPQA3.8Score33.5

Interactive version: theaggregate.ai/model?slug=romulus-mistral-nemo-12b-simpo · How It Works · Data refreshed daily, snapshot 2026-09-08.