Qwen 3.6 35B A3B (Reasoning): benchmark results

Provider: Alibaba. Released 2026-04-16. Access: Open.

Unified ELO 1606 ± 1, rank #406 of 1761 rated models, from 37 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench95.32Accuracy (%)94.5
CritPt30Accuracy (self-reported)80.8
AA Terminal-Bench Hard34.85Accuracy (%)80.3
AA IFBench64.35Accuracy (%)75.4
AA GPQA Diamond84.14Accuracy (%)75
AA Humanity's Last Exam22.24Accuracy (%)74.7
AA Omniscience - Software Engineering (SWE) - JavaScript36.36Accuracy (%)74.6
Artificial Analysis Intelligence Index26.21Intelligence Index74.4
AA Omniscience - Software Engineering (SWE) - Rust56Accuracy (%)74.1
AA Omniscience - Software Engineering (SWE) - C43Accuracy (%)70.8
AA Long Context Reasoning71.67Accuracy (%)70.7
AA MMMU-Pro75.03Accuracy (%)70.3

Interactive version: theaggregate.ai/model?slug=qwen-3-6-35b-a3b-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.