Qwen 3.5 0.8B (Non-reasoning): benchmark results

Provider: Alibaba. Released 2026-03-02. Access: Open.

Unified ELO 1401 ± 1, rank #2485 of 3078 rated models, from 52 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Tau2-Bench Telecom65.2Success Rate (%)60.5
AA TAU-2 Bench65.2Accuracy (%)59.1
AA Humanity's Last Exam5.1Accuracy (%)31.2
AA Omniscience - Software Engineering (SWE) - Julia4Accuracy (%)30.4
AA CritPt0Accuracy (%)23.9
AA Omniscience - Software Engineering (SWE) - Go8Accuracy (%)20
AA Omniscience - Software Engineering (SWE) - Java9Accuracy (%)18.8
AA Omniscience - Software Engineering (SWE) - TypeScript7.78Accuracy (%)16.2
AA Long Context Reasoning8Accuracy (%)15.2
AA Omniscience - Software Engineering (SWE) - Dart8Accuracy (%)11.4
AA Omniscience - Software Engineering (SWE) - HTML14Accuracy (%)11.3
FrameBench - Frame Identification - English49.5Accuracy (%; FrameNet candidate frames)10.5

Interactive version: theaggregate.ai/model?slug=qwen-3-5-0-8b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.