Qwen 3.5 122B A10B (Reasoning): benchmark results
Qwen 3.5 122B A10B evaluated with reasoning enabled. Provider: Alibaba. Released 2026-02-24. Access: Open.
Unified ELO 1637 ± 1, rank #292 of 1761 rated models, from 57 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CPTU Bench | 4.36 | Average Score (1-5) | 98 |
| AA IFBench | 75.71 | Accuracy (%) | 93.9 |
| AA Global-MMLU-Lite - Italian | 92.58 | Accuracy (%) | 92.3 |
| CritPt | 60 | Accuracy (self-reported) | 91.9 |
| AA TAU-2 Bench | 93.57 | Accuracy (%) | 90.5 |
| AA Global-MMLU-Lite - Korean | 89.83 | Accuracy (%) | 90.1 |
| AA Global-MMLU-Lite - Chinese | 91.08 | Accuracy (%) | 89.6 |
| AA Global-MMLU-Lite - French | 91.92 | Accuracy (%) | 87.8 |
| AA Global-MMLU-Lite - Indonesian | 91 | Accuracy (%) | 87.4 |
| AA Global-MMLU-Lite - Spanish | 92.42 | Accuracy (%) | 87.4 |
| AA Global-MMLU-Lite - Arabic | 89.5 | Accuracy (%) | 86.9 |
| AA Global-MMLU-Lite - German | 91.58 | Accuracy (%) | 85.6 |
Interactive version: theaggregate.ai/model?slug=qwen-3-5-122b-a10b-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.