Dans-PersonalityEngine-V1.1.0-12B — benchmark results

PocketDoc's multi-purpose fine-tune of Mistral Nemo Base 12B on 56 datasets spanning roleplay, co-writing, instructions, and tool use. Provider: Other. Released 2024-12-19. Access: Open.

Unified ELO 1512 ± 25, rank #763 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR17.3Score88.4
Open LLM Leaderboard - IFEval70.75Score83.9
Open LLM Leaderboard - BBH33.67Score66
UGI - Willingness (W/10)5.8W/10 Score49.3
Open LLM Leaderboard - MATH Level 510.5Score48.9
Open LLM Leaderboard - MMLU-Pro25.13Score45
Open LLM Leaderboard - GPQA4.92Score41.7
UGI Leaderboard32.44UGI Score41.1
UGI - Natural Intelligence19.48NatInt Score38.8
UGI - Writing27.48Writing Score29.2

Interactive version: theaggregate.ai/model?slug=dans-personalityengine-v1-1-0-12b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.