Qwen2.5-7B-Instruct-abliterated — benchmark results

huihui-ai's original abliterated Qwen2.5 7B Instruct with refusals removed, first in a series later revised as v2 and v3. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1469 ± 12, rank #910 of 1776 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard690.11Average Score (%)95.9
Open LLM Leaderboard - MATH Level 545.77Score93.9
Open LLM Leaderboard - IFEval75.46Score90.9
Open Arabic LLM - Madinah QA Arabic Language (Grammar)60.82Accuracy (%)85.8
Open Arabic LLM - Madinah QA Average63.01Accuracy (%)79.6
Open LLM Leaderboard - MMLU-Pro35.33Score76
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)44.11Accuracy (%)75
Open Arabic LLM - Aratrust Illegal90.57Accuracy (%)73.9
Open LLM Leaderboard - GPQA8.72Score71.9
Open Arabic LLM - Arabic MMLU HT College Chemistry43Accuracy (%)71.3
Open Arabic LLM - Alghafa Multiple Choice Sentiment Task39.88Accuracy (%)66.4
Open Arabic LLM - Aratrust Privacy92.98Accuracy (%)64.9

Interactive version: theaggregate.ai/model?slug=qwen2-5-7b-instruct-abliterated · How the rankings work · Data refreshed daily, snapshot 2026-07-22.