Qwen2.5-7B-Instruct-Uncensored: benchmark results

Orion-zhen's uncensored SFT+DPO fine-tune of Qwen2.5 7B Instruct, trained to remove refusals while keeping base capabilities. Provider: Alibaba. Released 2024-09-26. Access: Open.

Unified ELO 1541 ± 1, rank #476 of 1392 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard49.41Average Score (%)97.5
Open LLM Leaderboard - MATH Level 547.73Score95.3
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)54.25Accuracy (%)85.8
Open LLM Leaderboard - IFEval72.04Score85.7
Open Arabic LLM - Madinah QA Arabic Language (Grammar)59.18Accuracy (%)84.6
Open Arabic LLM - Madinah QA Average64.23Accuracy (%)83.3
Open LLM Leaderboard - MMLU-Pro38.07Score82.1
Open Arabic LLM - Aratrust Unfairness92.73Accuracy (%)82
Open Arabic LLM - Arabic MMLU HT College Computer Science49Accuracy (%)76.5
Open LLM Leaderboard - MuSR13.58Score74.6
Open Arabic LLM - Aratrust Illegal90.57Accuracy (%)73.9
Open Arabic LLM - Arabic MMLU HT Moral Scenarios34.41Accuracy (%)72.8

Interactive version: theaggregate.ai/model?slug=qwen2-5-7b-instruct-uncensored · How It Works · Data refreshed daily, snapshot 2026-09-05.