Qwen 3.5 27B (Non-reasoning) — benchmark results

Qwen 3.5 27B evaluated with reasoning disabled. Provider: Alibaba. Released 2026-02-24. Access: Open.

Unified ELO 1616 ± 30, rank #442 of 1776 rated models, from 53 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA GPQA Diamond84.24Accuracy (%)81.6
AA TAU-2 Bench87.13Accuracy (%)80.8
AA Terminal-Bench Hard31.82Accuracy (%)75.3
Artificial Analysis Intelligence Index29.31Intelligence Index74.2
UGI - Writing39.94Writing Score73.6
UGI - Natural Intelligence28.8NatInt Score71.7
AA Humanity's Last Exam13.21Accuracy (%)70.9
AA Global-MMLU-Lite - Yoruba64.75Accuracy (%)69.4
AA Global-MMLU-Lite - Indonesian87.67Accuracy (%)66.7
AA Global-MMLU-Lite - Japanese87Accuracy (%)66.5
AA Long Context Reasoning55.67Accuracy (%)65.8
AA Global-MMLU-Lite - German88.5Accuracy (%)64.8

Interactive version: theaggregate.ai/model?slug=qwen-3-5-27b-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.