Yi-1.5-9B-Chat-abliterated — benchmark results

byroneverson's abliterated Yi-1.5 9B Chat with the refusal direction removed, with the process documented in an included Jupyter notebook. Provider: 01.AI. Released 2024-09-04. Access: Open.

Unified ELO 1445 ± 15, rank #1024 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K59.14Accuracy (%)83.1
Open LLM Leaderboard - MuSR13.66Score75.2
Open Korean LLM Leaderboard384.42Average Score (%)75
Open Chinese LLM Leaderboard61.74Average Score (%)73.6
Open Chinese LLM - C-Eval Semantic82.13Accuracy (%)72.1
Open Chinese LLM - ARC Challenge55.63Accuracy (%)69.1
Open LLM Leaderboard - IFEval57.23Score69.1
Open LLM Leaderboard - BBH34.35Score67.9
Open Chinese LLM - CMMLU59.04Accuracy (%)66.8
Open LLM Leaderboard - MATH Level 516.62Score64.9
Open Chinese LLM - HellaSwag60.98Accuracy (%)60.7
Open LLM Leaderboard - MMLU-Pro30.17Score60.7

Interactive version: theaggregate.ai/model?slug=yi-1-5-9b-chat-abliterated · How the rankings work · Data refreshed daily, snapshot 2026-07-22.