Qwen 3.5 122B A10B (Reasoning) — benchmark results
Qwen 3.5 122B A10B evaluated with reasoning enabled. Provider: Alibaba. Released 2026-02-24. Access: Open.
Unified ELO 1694 ± 34, rank #281 of 1776 rated models, from 56 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA IFBench | 75.71 | Accuracy (%) | 93.9 |
| AA Global-MMLU-Lite - Italian | 92.58 | Accuracy (%) | 92.7 |
| AA TAU-2 Bench | 93.57 | Accuracy (%) | 90.5 |
| AA Global-MMLU-Lite - Korean | 89.83 | Accuracy (%) | 90.4 |
| AA Global-MMLU-Lite - Chinese | 91.08 | Accuracy (%) | 89.7 |
| AA Global-MMLU-Lite - French | 91.92 | Accuracy (%) | 88.5 |
| AA Global-MMLU-Lite - Indonesian | 91 | Accuracy (%) | 88 |
| AA Global-MMLU-Lite - Spanish | 92.42 | Accuracy (%) | 88 |
| AA Global-MMLU-Lite - Arabic | 89.5 | Accuracy (%) | 87.7 |
| AA Global-MMLU-Lite - German | 91.58 | Accuracy (%) | 86.4 |
| AA Long Context Reasoning | 66.67 | Accuracy (%) | 86.2 |
| AA Global-MMLU-Lite - Japanese | 90.42 | Accuracy (%) | 86.1 |
Interactive version: theaggregate.ai/model?slug=qwen-3-5-122b-a10b-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.