QVQ-72B-Preview — benchmark results

Alibaba's experimental 72B visual-reasoning model built on Qwen2-VL-72B, released as a December 2024 research preview. Provider: Alibaba. Released 2024-12-24. Access: Open.

Unified ELO 1558 ± 13, rank #602 of 1776 rated models, from 115 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LMM Reasoning - MathVerse - Applied53.2Accuracy (%)98
Open LMM Reasoning - MathVista - STA86.7Accuracy (%)98
Open LMM Reasoning - MathVista - FQA77.7Accuracy (%)96.4
Open LMM Reasoning - MathVerse - Coordinate75Accuracy (%)95.9
Open LMM Reasoning - LogicVista - numerical84.2Accuracy (%)93.8
Open LMM Reasoning - MathVision - analytic geometry46.4Accuracy (%)93.4
Open LMM Reasoning - LogicVista58.2Accuracy (%)93.2
Open LMM Reasoning - DynaMath - Subject-analytic geometry; Avg56.9Accuracy (%)92.9
Open LMM Reasoning - MathVerse - Plane Geometry51.6Accuracy (%)92.9
Open LMM Reasoning - DynaMath - Subject-analytic geometry22.7Accuracy (%)92.3
Open LMM Reasoning - LogicVista - deductive81.7Accuracy (%)92
Open LMM Reasoning - DynaMath - Subject-puzzle test; Avg54.1Accuracy (%)91.8

Interactive version: theaggregate.ai/model?slug=qvq-72b-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.