Dans-PersonalityEngine-V1.2.0-24B: benchmark results

PocketDoc's multipurpose fine-tune of Mistral Small 24B for roleplay, co-writing, and general instruction tasks. Provider: Other. Released 2025-02-17. Access: Open.

Unified ELO 1586 ± 1, rank #303 of 1392 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval78.86Score95.8
Open LLM Leaderboard - MMLU-Pro44.73Score87.9
Open LLM Leaderboard - BBH47.56Score87.5
UGI - Willingness (W/10)7.5W/10 Score77.9
Open LLM Leaderboard - MATH Level 524.55Score77.7
Open LLM Leaderboard - GPQA9.17Score74.3
Open LLM Leaderboard - MuSR13.38Score73.7
UGI Leaderboard39.54UGI Score65.2
UGI - Natural Intelligence26.03NatInt Score64.8
UGI - Writing30.95Writing Score40.3

Interactive version: theaggregate.ai/model?slug=dans-personalityengine-v1-2-0-24b · How It Works · Data refreshed daily, snapshot 2026-09-05.