Dans-PersonalityEngine-V1.1.0-12B — benchmark results
PocketDoc's multi-purpose fine-tune of Mistral Nemo Base 12B on 56 datasets spanning roleplay, co-writing, instructions, and tool use. Provider: Other. Released 2024-12-19. Access: Open.
Unified ELO 1512 ± 25, rank #763 of 1776 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MuSR | 17.3 | Score | 88.4 |
| Open LLM Leaderboard - IFEval | 70.75 | Score | 83.9 |
| Open LLM Leaderboard - BBH | 33.67 | Score | 66 |
| UGI - Willingness (W/10) | 5.8 | W/10 Score | 49.3 |
| Open LLM Leaderboard - MATH Level 5 | 10.5 | Score | 48.9 |
| Open LLM Leaderboard - MMLU-Pro | 25.13 | Score | 45 |
| Open LLM Leaderboard - GPQA | 4.92 | Score | 41.7 |
| UGI Leaderboard | 32.44 | UGI Score | 41.1 |
| UGI - Natural Intelligence | 19.48 | NatInt Score | 38.8 |
| UGI - Writing | 27.48 | Writing Score | 29.2 |
Interactive version: theaggregate.ai/model?slug=dans-personalityengine-v1-1-0-12b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.