Qwen 3 Coder Plus — benchmark results
Alibaba's hosted agentic-coding API tier built on Qwen3-Coder 480B A35B MoE, with up to 1M context. Provider: Alibaba. Released 2025-09-23. Access: Open.
Unified ELO 1571 ± 30, rank #563 of 1776 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| WebCoderBench - Performance | 98.54 | Score (%) | 100 |
| SnakeBench | 24.9 | TrueSkill Rating | 64 |
| BenchTable | 51.3 | Total Score (%) | 54.9 |
| MCPMark | 24.8 | Pass@1 (%) | 52.6 |
| BacktestBench | 42.05 | Overall Accuracy (OA) (self-reported) | 45.5 |
| AI Chess Leaderboard (Reasoning) | 639 | Elo | 45.2 |
| WebCoderBench - Functionality Correctness | 54.95 | Score (%) | 30.8 |
| Spider 2.0-Snow | 37.8 | Accuracy (%) | 30 |
| ALE-Bench | 456.5 | Performance (Self-Refine x1) (self-reported) | 23.1 |
| AssertLLM2 | 18.55 | Coverage Formal (self-reported) | 20 |
| FrontierOR | 20 | Sol. quality (self-reported) | 16.7 |
| WebCoderBench - Visual Experience | 46.27 | Score (%) | 15.4 |
Interactive version: theaggregate.ai/model?slug=qwen-3-coder-plus · How the rankings work · Data refreshed daily, snapshot 2026-07-22.