Daredevil-8B-abliterated-dpomix: benchmark results

Provider: Other. Released 2024-06-01. Access: Open.

Unified ELO 1540 ± 15, rank #885 of 2656 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard47.1Average Score (%)94.5
Open Ko-LLM Leaderboard47.1Average (%)94.4
Open Medical LLM - MMLU Medical Genetics84Accuracy (%)93.2
Open Korean LLM - Ko-IFEval49.63Strict accuracy, prompt/instruction mean (%)93.1
Open Korean LLM - Ko-GSM8K (flexible extract)58.07Exact match, flexible extract (%)92.2
Open Medical LLM - PubMedQA77.4Accuracy (%)92
Open Korean LLM - KorNAT-Helpful51.23Normalized accuracy (%)89.4
Open Medical LLM - MedMCQA58.09Accuracy (%)88.6
Open Korean LLM - Ko-EQ-Bench37.5EQ-Bench score88.2
Open Medical LLM70.99Average Accuracy (%)84.7
Open Medical-LLM Leaderboard70.99Medical average (%)83.9
Open Medical LLM - MMLU College Medicine67.05Accuracy (%)82.1

Interactive version: theaggregate.ai/model?slug=daredevil-8b-abliterated-dpomix · How It Works · Data refreshed daily, snapshot 2026-09-19.