romulus-mistral-nemo-12B-simpo — benchmark results

Axolotl AI's SimPO preference-optimization fine-tune of Mistral Nemo 12B, trained on Princeton's gemma2-ultrafeedback-armorm pairs. Provider: Other. Released 2024-07-24. Access: Open.

Unified ELO 1522 ± 70, rank #715 of 1776 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard767.43Average Score (%)97.3
Open LLM Leaderboard - IFEval60.79Score72.8
Open LLM Leaderboard - MuSR12.98Score71.3
Open LLM Leaderboard - BBH34.64Score69.1
Open LLM Leaderboard - MATH Level 511.4Score51.8
Open LLM Leaderboard - MMLU-Pro27.43Score50.4
Open LLM Leaderboard - GPQA3.8Score33.5

Interactive version: theaggregate.ai/model?slug=romulus-mistral-nemo-12b-simpo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.