Qwen 3 VL 235B A22B — benchmark results

Alibaba Qwen 3 VL 235B A22B vision-language model row. Provider: Alibaba. Released 2025-09-22. Access: Open.

Unified ELO 1660 ± 28, rank #346 of 1776 rated models, from 40 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SciEval - Physics49.93Physics (%)100
MMMU Benchmark78.7Validation Score94.2
GeoSym-Bench77.34Overall (self-reported)90.5
VeriTrip68.26DR (Simple) (self-reported)90
SGI-Bench Wet Experiment30.3Wet Experiment Score77.8
SciEval - Chemistry77.39Chemistry (%)77.8
SciEval - Life Sciences56.69Life Sciences (%)77.8
SciEval - Overall60.58Overall (%)77.8
IDP Leaderboard76.8Avg Score (%)72
Perception or Prejudice12.8HR (self-reported)69.2
SciEval - Materials Science81.85Materials Science (%)66.7
OmniDocBench 1.589.15Overall (self-reported)63.3

Interactive version: theaggregate.ai/model?slug=qwen-3-vl-235b-a22b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.