Josiefied-Qwen2.5-7B-Instruct-abliterated-v2 — benchmark results

Goekdeniz-Guelmez's abliterated and re-fine-tuned Qwen2.5 7B Instruct from the JOSIEFIED series, built for refusal-free responses. Provider: Other. Released 2024-09-20. Access: Open.

Unified ELO 1496 ± 10, rank #812 of 1776 rated models, from 130 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval78.41Score95
Open LLM Leaderboard - MATH Level 547.21Score95
Open Korean LLM Leaderboard537.9Average Score (%)91.3
Open LLM Leaderboard - MuSR13.96Score76.6
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task54.15Accuracy (%)75.9
Open LLM Leaderboard - MMLU-Pro34.76Score75.1
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)43.84Accuracy (%)74.1
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task90.67Accuracy (%)73.1
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment NO Neutral Task78.57Accuracy (%)71.6
Open Arabic LLM - Arabic MMLU Computer Science (Primary School)74.74Accuracy (%)71.6
Open Arabic LLM - Madinah QA Arabic Language (Grammar)46.03Accuracy (%)71.6
Open Arabic LLM - Madinah QA Average57.33Accuracy (%)69.8

Interactive version: theaggregate.ai/model?slug=josiefied-qwen2-5-7b-instruct-abliterated-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.