Qwen 3.5 9B (Non-reasoning): benchmark results

Qwen 3.5 9B evaluated with reasoning disabled. Provider: Alibaba. Released 2026-03-02. Access: Open.

Unified ELO 1542 ± 1, rank #662 of 1761 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CritPt60Accuracy (self-reported)91.9
AA TAU-2 Bench85.09Accuracy (%)77.4
AA GPQA Diamond78.59Accuracy (%)64.7
AA CritPt0.57Accuracy (%)59
AA Terminal-Bench Hard18.18Accuracy (%)57.3
Artificial Analysis Intelligence Index14.13Intelligence Index56.4
AA Omniscience - Software Engineering (SWE) - C32Accuracy (%)52.9
AA Humanity's Last Exam9.36Accuracy (%)52.1
UGI - Writing33.52Writing Score49.6
AA Omniscience - Software Engineering (SWE) - Go16Accuracy (%)48.6
OTIS Mock AIME 2024-2561.67Accuracy (%)46.2
AA MMMU-Pro66.76Accuracy (%)45.3

Interactive version: theaggregate.ai/model?slug=qwen-3-5-9b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.