Meta-Llama-3-70B-Instruct-abliterated-v3.5 — benchmark results
failspy's abliterated Llama 3 70B Instruct (v3.5) with the refusal direction orthogonalized out of the weights, modifying only a single layer. Provider: Other. Released 2024-05-28. Access: Open.
Unified ELO 1446 ± 22, rank #1019 of 1776 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 77.47 | Score | 93.4 |
| Open LLM Leaderboard - MMLU-Pro | 38.36 | Score | 82.6 |
| Open LLM Leaderboard - BBH | 37.87 | Score | 77.8 |
| Open Chinese LLM - CMMLU | 64.66 | Accuracy (%) | 76.6 |
| Open Chinese LLM - C-Eval Semantic | 82.45 | Accuracy (%) | 73 |
| Open Chinese LLM Leaderboard | 60.24 | Average Score (%) | 70.9 |
| Open Chinese LLM - GSM8K | 49.58 | Accuracy (%) | 65.6 |
| Open Chinese LLM - ARC Challenge | 53.67 | Accuracy (%) | 58.8 |
| Open LLM Leaderboard - MATH Level 5 | 12.84 | Score | 57 |
| Open LLM Leaderboard - GPQA | 6.26 | Score | 52.5 |
| Open Chinese LLM - HellaSwag | 59.83 | Accuracy (%) | 48.4 |
| Open LLM Leaderboard - MuSR | 7.97 | Score | 37.3 |
Interactive version: theaggregate.ai/model?slug=meta-llama-3-70b-instruct-abliterated-v3-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.