Qwen2.5-32B-Instruct-abliterated: benchmark results

Provider: Alibaba. Released 2024-09-29. Access: Open.

Unified ELO 1667 ± 30, rank #408 of 2656 rated models, from 132 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - BLUEX78.58Accuracy (%)97.8
Open Portuguese LLM - ASSIN2 RTE94.48Macro F1 (%)96.8
Open Portuguese LLM - ENEM83.41Accuracy (%)96.7
Open Arabic LLM - Arabic MMLU HT High School Computer Science83Accuracy (%)95.4
Open Portuguese LLM - OAB Exams62.78Accuracy (%)95.2
Open Arabic LLM - Arabic MMLU HT Virology52.41Accuracy (%)93.8
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Soqal Task94Accuracy (%)93.5
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task55.56Accuracy (%)92
Open Arabic LLM - Arabic MMLU Math (Primary School)78.48Accuracy (%)92
Open Arabic LLM - Arabic MMLU HT Abstract Algebra47Accuracy (%)91.4
Open Arabic LLM - Arabic MMLU History (Primary School)71.57Accuracy (%)90.4
Open Arabic LLM - Aratrust Privacy96.49Accuracy (%)90.4

Interactive version: theaggregate.ai/model?slug=qwen2-5-32b-instruct-abliterated · How It Works · Data refreshed daily, snapshot 2026-09-19.