Llama-3-8B-Instruct-abliterated-v2 — benchmark results

Provider: Meta. Released 2024-06-01. Access: Open.

Unified ELO 1350 ± 17, rank #1413 of 1776 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard466.5Average Score (%)84.2
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7
Open Medical LLM - MedQA (USMLE)60.96Accuracy (%)80.1
Open Medical LLM - MMLU Medical Genetics80Accuracy (%)67
Open Medical LLM - MedMCQA56.32Accuracy (%)65.9
Open Medical LLM - MMLU Anatomy64.44Accuracy (%)65.1
Open Medical LLM68.05Average Accuracy (%)60.2
Open Medical LLM - MMLU Professional Medicine70.59Accuracy (%)56.2
Open Medical LLM - MMLU Clinical Knowledge71.32Accuracy (%)52.8
Open CoT - LSAT Logical Reasoning10.2CoT Gain (%)49.2
Open Chinese LLM - GSM8K44.96Accuracy (%)47
Open Chinese LLM - CMMLU53.03Accuracy (%)46.6

Interactive version: theaggregate.ai/model?slug=llama-3-8b-instruct-abliterated-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.