llama-3-70B-Instruct-abliterated — benchmark results

failspy's abliterated Llama 3 70B Instruct with the refusal direction orthogonalized out of the weights. Provider: Meta. Released 2024-05-07. Access: Open.

Unified ELO 1491 ± 29, rank #835 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K71.34Accuracy (%)97.9
Open LLM Leaderboard - IFEval80.23Score97.7
Open Chinese LLM - CMMLU71.56Accuracy (%)91.7
Open LLM Leaderboard - BBH48.94Score89.5
Open LLM Leaderboard - MMLU-Pro46.06Score89.1
Open Chinese LLM - ARC Challenge59.73Accuracy (%)86.2
Open Chinese LLM Leaderboard66.78Average Score (%)85.8
Open Chinese LLM - C-Eval Semantic86.75Accuracy (%)81.8
Open LLM Leaderboard - MATH Level 524.32Score77.5
Open Chinese LLM - HellaSwag63.32Accuracy (%)72.4
Open LLM Leaderboard - MuSR10.53Score53
Open LLM Leaderboard - GPQA5.26Score44

Interactive version: theaggregate.ai/model?slug=llama-3-70b-instruct-abliterated · How the rankings work · Data refreshed daily, snapshot 2026-07-22.