Aquila-VL-2B: benchmark results

Provider: BAAI. Released 2024-10-30. Access: Open.

Unified ELO 1386 ± 1, rank #1183 of 1392 rated models, from 988 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenVLM MMT-Bench - Sketch-to-Code70Score (%)99.5
OpenVLM MMT-Bench - Other Biological Attributes90Score (%)97.8
OpenVLM MMT-Bench - Scene Recognition85Score (%)97.3
MEGA-Bench Task - MMSoc Memotion68.2Task Score (%)96.5
MEGA-Bench Task - Paper Review Acceptance60Task Score (%)96.5
OpenVLM MMT-Bench - Tech Engineering55.6Score (%)96.4
OpenVLM MMBench V1.1 EN - Image Topic98.9Accuracy (%)95.2
OpenVLM MMT-Bench - Animals Recognition100Score (%)94.9
MEGA-Bench Task - MVSA Sentiment Classification78.6Task Score (%)94.2
MEGA-Bench Task - Video Grounding Temporal40Task Score (%)94.2
OpenVLM MMT-Bench - Fashion Recognition85Score (%)94.2
OpenVLM MMBench V1.1 EN - Attribute Recognition96.6Accuracy (%)93.6

Interactive version: theaggregate.ai/model?slug=aquila-vl-2b · How It Works · Data refreshed daily, snapshot 2026-09-05.