Violet_Twilight-v0.2: benchmark results

Epiculous's SLERP merge of its Azure_Dusk and Crimson_Dawn v0.2 tunes, a roleplay-leaning Mistral Nemo 12B model. Provider: Other. Released 2024-09-12. Access: Open.

Unified ELO 1504 ± 1, rank #675 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR13.61Score74.8
UGI - Writing34.55Writing Score53.1
Open LLM Leaderboard - IFEval45.32Score50.1
Open LLM Leaderboard - MMLU-Pro23.45Score40.5
UGI - Natural Intelligence18.96NatInt Score36.6
Open LLM Leaderboard - BBH23.94Score36.2
UGI - Willingness (W/10)4W/10 Score30.4
UGI Leaderboard25.86UGI Score21.1
Open LLM Leaderboard - GPQA2.13Score20.3
Open LLM Leaderboard - MATH Level 52.87Score18.2

Interactive version: theaggregate.ai/model?slug=violet-twilight-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-05.