Qwen 3 235B A22B 2507 Instruct — benchmark results

Alibaba Qwen 3 235B A22B 2507 instruction-tuned checkpoint. Provider: Alibaba. Released 2025-07-01. Access: Open.

Unified ELO 1624 ± 7, rank #428 of 1776 rated models, from 263 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Galileo Agent - Insurance Accuracy74Accuracy (%)100
LLM Stats (MultiPL-E)87.9Score (%)100
EuroEval Spanish66.09Average Score (%)99.8
EuroEval Italian Common Sense Reasoning86.12Common Sense Reasoning Average Score (%)99.7
EuroEval Lithuanian NLU58.89NLU Average Score (%)99.6
EuroEval French73.2Average Score (%)99.5
EuroEval Danish Common Sense Reasoning85Common Sense Reasoning Average Score (%)99.4
EuroEval English78.94Average Score (%)99.4
EuroEval French Common Sense Reasoning85.74Common Sense Reasoning Average Score (%)99.4
EuroEval German66.96Average Score (%)99.4
EuroEval German Common Sense Reasoning86.72Common Sense Reasoning Average Score (%)99.4
EuroEval English Common Sense Reasoning91.73Common Sense Reasoning Average Score (%)99.1

Interactive version: theaggregate.ai/model?slug=qwen-3-235b-a22b-2507-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.