Meta-Llama-3-70B-Instruct-abliterated-v3.5 — benchmark results

failspy's abliterated Llama 3 70B Instruct (v3.5) with the refusal direction orthogonalized out of the weights, modifying only a single layer. Provider: Other. Released 2024-05-28. Access: Open.

Unified ELO 1446 ± 22, rank #1019 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval77.47Score93.4
Open LLM Leaderboard - MMLU-Pro38.36Score82.6
Open LLM Leaderboard - BBH37.87Score77.8
Open Chinese LLM - CMMLU64.66Accuracy (%)76.6
Open Chinese LLM - C-Eval Semantic82.45Accuracy (%)73
Open Chinese LLM Leaderboard60.24Average Score (%)70.9
Open Chinese LLM - GSM8K49.58Accuracy (%)65.6
Open Chinese LLM - ARC Challenge53.67Accuracy (%)58.8
Open LLM Leaderboard - MATH Level 512.84Score57
Open LLM Leaderboard - GPQA6.26Score52.5
Open Chinese LLM - HellaSwag59.83Accuracy (%)48.4
Open LLM Leaderboard - MuSR7.97Score37.3

Interactive version: theaggregate.ai/model?slug=meta-llama-3-70b-instruct-abliterated-v3-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.