Qwen 3 VL 235B A22B: benchmark results

Alibaba's open Qwen 3-VL 235B sparse MoE (22B active) vision-language model (September 2025). Provider: Alibaba. Released 2025-09-22. Access: Open.

Unified ELO 1612 ± 1, rank #228 of 1392 rated models, from 48 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SciEval - Physics49.93Physics (%)100
MMMU Benchmark78.7Validation Score94.2
Diagram-MMU - Code Parsing55.98All Score (%)90.9
GeoSym-Bench77.34Overall (self-reported)90.5
Diagram-MMU - Code Editing52.25All Score (%)90
EviSafe - Natural Severity Accuracy51.9Accuracy (%)90
VeriTrip68.26DR (Simple) (self-reported)90
SGI-Bench Wet Experiment30.3Wet Experiment Score77.8
SciEval - Chemistry77.39Chemistry (%)77.8
SciEval - Life Sciences56.69Life Sciences (%)77.8
SciEval - Overall60.58Overall (%)77.8
IDP Leaderboard76.8Avg Score (%)72

Interactive version: theaggregate.ai/model?slug=qwen-3-vl-235b-a22b · How It Works · Data refreshed daily, snapshot 2026-09-05.