Llama-3-8B-Instruct-abliterated-dpomix: benchmark results

Provider: Meta. Released 2024-06-01. Access: Open.

Unified ELO 1491 ± 14, rank #1164 of 2656 rated models, from 26 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Medical LLM - MMLU Medical Genetics85Accuracy (%)97.4
Open Korean LLM - Ko-IFEval47.55Strict accuracy, prompt/instruction mean (%)91.9
Open Medical LLM - PubMedQA76.2Accuracy (%)82.1
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Medical LLM - MMLU Professional Medicine74.63Accuracy (%)80.7
Open Ko-LLM Leaderboard40.93Average (%)79.7
Open Korean LLM Leaderboard40.93Average Score (%)79.7
Open Portuguese LLM - OAB Exams50.98Accuracy (%)78.8
Open Portuguese LLM - ENEM70.54Accuracy (%)76.8
Open Medical LLM - MedQA (USMLE)60.64Accuracy (%)76.1
Open Medical LLM - MMLU College Medicine65.9Accuracy (%)75.3
Open Korean LLM - Ko-EQ-Bench25.92EQ-Bench score72.2

Interactive version: theaggregate.ai/model?slug=llama-3-8b-instruct-abliterated-dpomix · How It Works · Data refreshed daily, snapshot 2026-09-19.