Qwen2.5-7B-Instruct-Uncensored — benchmark results

Orion-zhen's uncensored SFT+DPO fine-tune of Qwen2.5 7B Instruct, trained to remove refusals while keeping base capabilities. Provider: Alibaba. Released 2024-09-26. Access: Open.

Unified ELO 1507 ± 11, rank #771 of 1776 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 547.73Score95.3
Open Korean LLM Leaderboard654.86Average Score (%)94.8
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)54.25Accuracy (%)85.8
Open LLM Leaderboard - IFEval72.04Score85.7
Open Arabic LLM - Madinah QA Arabic Language (Grammar)59.18Accuracy (%)84.6
Open Arabic LLM - Madinah QA Average64.23Accuracy (%)83.3
Open LLM Leaderboard - MMLU-Pro38.07Score82.1
Open Arabic LLM - Aratrust Unfairness92.73Accuracy (%)82
Open Arabic LLM - Arabic MMLU HT College Computer Science49Accuracy (%)76.5
Open LLM Leaderboard - MuSR13.58Score74.7
Open Arabic LLM - Aratrust Illegal90.57Accuracy (%)73.9
Open Arabic LLM - Arabic MMLU HT Moral Scenarios34.41Accuracy (%)72.8

Interactive version: theaggregate.ai/model?slug=qwen2-5-7b-instruct-uncensored · How the rankings work · Data refreshed daily, snapshot 2026-07-22.