Qwen 3.5 35B A3B (Reasoning) — benchmark results

Provider: Alibaba. Released 2026-02-24. Access: Open.

Unified ELO 1612 ± 20, rank #503 of 1806 rated models, from 52 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA IFBench72.52Accuracy (%)89.5
AA TAU-2 Bench89.18Accuracy (%)83.6
AA GPQA Diamond84.55Accuracy (%)81.1
AA Humanity's Last Exam21.04Accuracy (%)77.8
AA Global-MMLU-Lite - Portuguese90.42Accuracy (%)77.7
AA Global-MMLU-Lite - Italian90.42Accuracy (%)77.2
AA Long Context Reasoning68.33Accuracy (%)77.2
AA-LCR62.7Score (self-reported)76.8
AA Global-MMLU-Lite - Bengali86.58Accuracy (%)76.3
AA Global-MMLU-Lite - Burmese81.75Accuracy (%)75
AA Global-MMLU-Lite - Chinese88.75Accuracy (%)74.1
AA Global-MMLU-Lite - Yoruba69Accuracy (%)73.9

Interactive version: theaggregate.ai/model?slug=qwen-3-5-35b-a3b-reasoning · How It Works · Data refreshed daily, snapshot 2026-08-07.