Qwen 3.5 Plus (2026-04-20): benchmark results

April 20, 2026 Qwen 3.5 Plus snapshot, tracked when sources report the dated API model. Provider: Alibaba. Released 2026-02-16. Access: API.

Unified ELO 1777 ± 48, rank #188 of 2656 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
THOR Finding Triage - False Review Load23.7False positives not suppressed (%, lower is better)98.1
TriageBench44Decision Accuracy (%)96.4
SvelteBench98.9Average pass@1 (%)91.3
Wolfram LLM Benchmarking Project58.8Correct Functionality (%)86.4
THOR Finding Triage - CW%63.7Confidence-weighted classification score (%)80.6
Tinybird AI SQL Benchmark - First-Attempt Success Rate98Questions answered with a valid query on the first attempt (78.1
Tinybird AI SQL Benchmark - Exactness51.81Result exactness vs human reference queries (0-100)73
LM Market Cap LMC Score74.8LMC Score (0-100)72.5
Tinybird AI SQL Benchmark - Success Rate100Questions answered with a valid query within 3 retries (%)72.5
ObviousBench91.67Answer pass³ (%)52.9
THOR Finding Triage - Balanced OTS52.8Class-balanced operational triage score (%)28.7
SnakeBench17.2TrueSkill Rating27.4

Interactive version: theaggregate.ai/model?slug=qwen-3-5-plus-2026-04-20 · How It Works · Data refreshed daily, snapshot 2026-09-19.