Qwen 3 235B A22B 2507 Instruct — benchmark results
Alibaba Qwen 3 235B A22B 2507 instruction-tuned checkpoint. Provider: Alibaba. Released 2025-07-01. Access: Open.
Unified ELO 1624 ± 7, rank #428 of 1776 rated models, from 263 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Galileo Agent - Insurance Accuracy | 74 | Accuracy (%) | 100 |
| LLM Stats (MultiPL-E) | 87.9 | Score (%) | 100 |
| EuroEval Spanish | 66.09 | Average Score (%) | 99.8 |
| EuroEval Italian Common Sense Reasoning | 86.12 | Common Sense Reasoning Average Score (%) | 99.7 |
| EuroEval Lithuanian NLU | 58.89 | NLU Average Score (%) | 99.6 |
| EuroEval French | 73.2 | Average Score (%) | 99.5 |
| EuroEval Danish Common Sense Reasoning | 85 | Common Sense Reasoning Average Score (%) | 99.4 |
| EuroEval English | 78.94 | Average Score (%) | 99.4 |
| EuroEval French Common Sense Reasoning | 85.74 | Common Sense Reasoning Average Score (%) | 99.4 |
| EuroEval German | 66.96 | Average Score (%) | 99.4 |
| EuroEval German Common Sense Reasoning | 86.72 | Common Sense Reasoning Average Score (%) | 99.4 |
| EuroEval English Common Sense Reasoning | 91.73 | Common Sense Reasoning Average Score (%) | 99.1 |
Interactive version: theaggregate.ai/model?slug=qwen-3-235b-a22b-2507-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.