Qwen 3.5 122B A10B (Non-reasoning): benchmark results
Qwen 3.5 122B A10B evaluated with reasoning disabled. Provider: Alibaba. Released 2026-02-24. Access: Open.
Unified ELO 1609 ± 1, rank #387 of 1761 rated models, from 61 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CritPt | 90 | Accuracy (self-reported) | 97.7 |
| CPTU Bench | 4.26 | Average Score (1-5) | 91.1 |
| AA Global-MMLU-Lite - Indonesian | 89.58 | Accuracy (%) | 77.9 |
| UGI - Natural Intelligence | 31.08 | NatInt Score | 76.7 |
| AA Global-MMLU-Lite - Italian | 90.42 | Accuracy (%) | 76.1 |
| AA Global-MMLU-Lite - Yoruba | 71.08 | Accuracy (%) | 76.1 |
| AA TAU-2 Bench | 84.5 | Accuracy (%) | 75.7 |
| AA Global-MMLU-Lite - Japanese | 88.08 | Accuracy (%) | 74.3 |
| AA Global-MMLU-Lite - Korean | 87 | Accuracy (%) | 74.3 |
| AA Omniscience - Software Engineering (SWE) - Rust | 56 | Accuracy (%) | 74.1 |
| AA Global-MMLU-Lite - French | 89.83 | Accuracy (%) | 73.9 |
| AA Terminal-Bench Hard | 29.55 | Accuracy (%) | 71.7 |
Interactive version: theaggregate.ai/model?slug=qwen-3-5-122b-a10b-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.