VLAA-Thinker-Qwen2.5VL-7B — benchmark results

Provider: Other. Released 2025-03-31. Access: Open.

Unified ELO 1533 ± 10, rank #704 of 1841 rated models, from 99 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LMM Reasoning - WeMath - Correspondence of Coordinates and Positions93.3Accuracy (%)100
Open LMM Reasoning - LogicVista - inductive43Accuracy (%)98.1
Open LMM Reasoning - MathVerse - Angle54.9Accuracy (%)95.9
Open LMM Reasoning - MathVerse - Plane Geometry53.3Accuracy (%)95.9
Open LMM Reasoning - MathVision - topology34.8Accuracy (%)94.9
Open LMM Reasoning - MathVerse - Applied51.4Accuracy (%)94.4
OpenVLM MathVista - FQA75.5Accuracy (%)92.5
Open LMM Reasoning - MathVerse48.2Accuracy (%)91.8
OpenVLM MathVista - STA84.4Accuracy (%)91.3
Open LMM Reasoning - WeMath - Calculation of Plane Figures82Accuracy (%)90.1
Open LMM Reasoning - MathVerse - Length56Accuracy (%)89.8
Open LMM Reasoning - WeMath - Understanding of Solid Figures67.7Accuracy (%)87.7

Interactive version: theaggregate.ai/model?slug=vlaa-thinker-qwen2-5vl-7b · How It Works · Data refreshed daily, snapshot 2026-07-25.