Lumimaid-v0.2-12B — benchmark results

NeverSleep's (Undi & IkariDev) roleplay fine-tune of Mistral Nemo Instruct 2407, v0.2 retrained on a heavily cleaned and deduplicated RP dataset. Provider: Other. Released 2024-07-25. Access: Open.

Unified ELO 1437 ± 67, rank #1058 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR21.3Score96.9
Open LLM Leaderboard - GPQA8.61Score71.4
Open LLM Leaderboard - BBH34.41Score68.3
Open LLM Leaderboard - MMLU-Pro27.91Score51.8
UGI - Writing31.95Writing Score44.6
UGI - Willingness (W/10)5.2W/10 Score41.4
Open LLM Leaderboard - MATH Level 55.66Score31.3
UGI - Natural Intelligence16.68NatInt Score27.4
UGI Leaderboard25.01UGI Score19.1
Open LLM Leaderboard - IFEval10.99Score2

Interactive version: theaggregate.ai/model?slug=lumimaid-v0-2-12b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.