VLAA-Thinker-Qwen2.5VL-3B — benchmark results

Provider: Other. Released 2025-03-31. Access: Open.

Unified ELO 1488 ± 13, rank #890 of 1841 rated models, from 98 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LMM Reasoning - MathVision - topology30.4Accuracy (%)89.3
Open LMM Reasoning - DynaMath - Subject-solid geometry26.7Accuracy (%)82.7
Open LMM Reasoning - WeMath - Angles and Length51Accuracy (%)82.1
OpenVLM MathVista - STA80.1Accuracy (%)82
OpenVLM MathVista - FQA70.6Accuracy (%)80.8
Open LMM Reasoning - MathVerse - Analytic44.2Accuracy (%)79.6
Open LMM Reasoning - MathVerse - Volume31.4Accuracy (%)79.6
Open LMM Reasoning - WeMath - Correspondence of Coordinates and Positions80Accuracy (%)79.6
Open LMM Reasoning - MathVision - analytic geometry36.9Accuracy (%)76.5
OpenVLM MathVista - LOG27Accuracy (%)75.5
Open LMM Reasoning - WeMath - InadequateGeneralization (Loose)13.5Accuracy (%)74.7
Open LMM Reasoning - MathVerse - Applied39.4Accuracy (%)74.5

Interactive version: theaggregate.ai/model?slug=vlaa-thinker-qwen2-5vl-3b · How It Works · Data refreshed daily, snapshot 2026-07-25.