Qwen 3.5 Plus (2026-04-20) — benchmark results
April 20, 2026 Qwen 3.5 Plus snapshot, tracked when sources report the dated API model. Provider: Alibaba. Released 2026-02-16. Access: API.
Unified ELO 1789 ± 48, rank #152 of 1776 rated models, from 30 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| StemBind | 42.2 | F Overall (self-reported) | 100 |
| TOBench | 41 | Avg. (self-reported) | 100 |
| EgoCoT-Bench | 70.68 | Mean (self-reported) | 94.4 |
| CC-OCR V2 | 73.03 | Average (self-reported) | 92.9 |
| SvelteBench | 98.9 | Average pass@1 (%) | 92.2 |
| Can Agents Price a Reaction? Evaluating LLMs o | 34.6 | C.10 Clean (self-reported) | 90.9 |
| StereoTales | 252 | Emissions (self-reported) | 90.9 |
| Disentangling Language Roles in Multilingual L | 82 | JointSuccess (self-reported) | 89.5 |
| SuiChat-CN | 74.2 | Standard F1 (self-reported) | 88.4 |
| Wolfram LLM Benchmarking Project | 58.8 | Correct Functionality (%) | 88 |
| OccuBench | 41 | Completion rate (self-reported) | 85.7 |
| ArchSIBench | 63.2 | Avg. (self-reported) | 85.2 |
Interactive version: theaggregate.ai/model?slug=qwen-3-5-plus-2026-04-20 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.