Daredevil-8B-abliterated: benchmark results

mlabonne's abliterated version of his Daredevil-8B Llama 3 merge, with the refusal direction removed for uncensored use. Provider: Other. Released 2024-06-01. Access: Open.

Unified ELO 1534 ± 1, rank #518 of 1392 rated models, from 31 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LSAT Reading Comprehension23.42CoT Gain (%)96.2
Open Korean LLM Leaderboard46.98Average Score (%)94.3
Open CoT Leaderboard14.25Average CoT Gain (%)93.9
Open CoT - LogiQA9.42CoT Gain (%)93.5
Open Medical LLM - MMLU Medical Genetics84Accuracy (%)93.2
Open CoT - LogiQA 215.01CoT Gain (%)92.7
Open Medical LLM - MedMCQA58.36Accuracy (%)89.2
Open Medical LLM - PubMedQA77Accuracy (%)89.2
Open CoT - LSAT Logical Reasoning18.63CoT Gain (%)87.8
Open Medical LLM - MedQA (USMLE)61.27Accuracy (%)84.7
Open Medical LLM70.86Average Accuracy (%)84.1
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7

Interactive version: theaggregate.ai/model?slug=daredevil-8b-abliterated · How It Works · Data refreshed daily, snapshot 2026-09-05.