Qwen 3.6 27B (Reasoning): benchmark results

Provider: Alibaba. Released 2026-04-22. Access: Open.

Unified ELO 1626 ± 1, rank #332 of 1761 rated models, from 37 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CPTU Bench4.41Average Score (1-5)99
AA TAU-2 Bench94.15Accuracy (%)92
AA Long Context Reasoning77.33Accuracy (%)81.7
AA IFBench67.55Accuracy (%)81
AA Terminal-Bench Hard34.85Accuracy (%)80.3
AA Omniscience - Software Engineering (SWE) - TypeScript33.33Accuracy (%)79.4
Artificial Analysis Intelligence Index29Intelligence Index79.2
AA Omniscience - Software Engineering (SWE) - Swift44Accuracy (%)78.2
AA Omniscience - Software Engineering (SWE) - HTML40Accuracy (%)75.9
AA GPQA Diamond84.24Accuracy (%)75.5
AA Humanity's Last Exam23.08Accuracy (%)75.4
AA-LCR73.33Accuracy (self-reported)74.2

Interactive version: theaggregate.ai/model?slug=qwen-3-6-27b-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.