Dans-PersonalityEngine-V1.2.0-24B — benchmark results

PocketDoc's multipurpose fine-tune of Mistral Small 24B for roleplay, co-writing, and general instruction tasks. Provider: Other. Released 2025-02-17. Access: Open.

Unified ELO 1570 ± 24, rank #567 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval78.86Score95.8
Open LLM Leaderboard - MMLU-Pro44.73Score87.9
Open LLM Leaderboard - BBH47.56Score87.5
Open LLM Leaderboard - MATH Level 524.55Score77.7
UGI - Willingness (W/10)7.5W/10 Score77.6
Open LLM Leaderboard - GPQA9.17Score74.3
Open LLM Leaderboard - MuSR13.38Score73.7
UGI Leaderboard39.54UGI Score65.6
UGI - Natural Intelligence26.03NatInt Score65.5
UGI - Writing30.95Writing Score40.8

Interactive version: theaggregate.ai/model?slug=dans-personalityengine-v1-2-0-24b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.