Qwen2.5-7B-Instruct-abliterated: benchmark results

huihui-ai's original abliterated Qwen2.5 7B Instruct with refusals removed, first in a series later revised as v2 and v3. Provider: Alibaba. Released 2024-09-19. Access: Open.

Unified ELO 1495 ± 1, rank #713 of 1392 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 545.77Score93.9
Open Korean LLM Leaderboard45.22Average Score (%)91.3
Open LLM Leaderboard - IFEval75.46Score90.9
Open Arabic LLM - Madinah QA Arabic Language (Grammar)60.82Accuracy (%)85.8
Open Arabic LLM - Madinah QA Average63.01Accuracy (%)79.6
Open LLM Leaderboard - MMLU-Pro35.33Score76
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)44.11Accuracy (%)75
Open Arabic LLM - Aratrust Illegal90.57Accuracy (%)73.9
Open LLM Leaderboard - GPQA8.72Score71.9
Open Arabic LLM - Arabic MMLU HT College Chemistry43Accuracy (%)71.3
Open Arabic LLM - Alghafa Multiple Choice Sentiment Task39.88Accuracy (%)66.4
Open Arabic LLM - Aratrust Privacy92.98Accuracy (%)64.9

Interactive version: theaggregate.ai/model?slug=qwen2-5-7b-instruct-abliterated · How It Works · Data refreshed daily, snapshot 2026-09-05.