QVQ-72B-Preview — benchmark results
Alibaba's experimental 72B visual-reasoning model built on Qwen2-VL-72B, released as a December 2024 research preview. Provider: Alibaba. Released 2024-12-24. Access: Open.
Unified ELO 1558 ± 13, rank #602 of 1776 rated models, from 115 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LMM Reasoning - MathVerse - Applied | 53.2 | Accuracy (%) | 98 |
| Open LMM Reasoning - MathVista - STA | 86.7 | Accuracy (%) | 98 |
| Open LMM Reasoning - MathVista - FQA | 77.7 | Accuracy (%) | 96.4 |
| Open LMM Reasoning - MathVerse - Coordinate | 75 | Accuracy (%) | 95.9 |
| Open LMM Reasoning - LogicVista - numerical | 84.2 | Accuracy (%) | 93.8 |
| Open LMM Reasoning - MathVision - analytic geometry | 46.4 | Accuracy (%) | 93.4 |
| Open LMM Reasoning - LogicVista | 58.2 | Accuracy (%) | 93.2 |
| Open LMM Reasoning - DynaMath - Subject-analytic geometry; Avg | 56.9 | Accuracy (%) | 92.9 |
| Open LMM Reasoning - MathVerse - Plane Geometry | 51.6 | Accuracy (%) | 92.9 |
| Open LMM Reasoning - DynaMath - Subject-analytic geometry | 22.7 | Accuracy (%) | 92.3 |
| Open LMM Reasoning - LogicVista - deductive | 81.7 | Accuracy (%) | 92 |
| Open LMM Reasoning - DynaMath - Subject-puzzle test; Avg | 54.1 | Accuracy (%) | 91.8 |
Interactive version: theaggregate.ai/model?slug=qvq-72b-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.