Aquila-VL-2B — benchmark results

Provider: BAAI. Released 2024-10-30. Access: Open.

Unified ELO 1290 ± 10, rank #1551 of 1776 rated models, from 1000 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenVLM MMT-Bench - Sketch-to-Code70Score (%)99.5
OpenVLM MMT-Bench - Other Biological Attributes90Score (%)97.8
OpenVLM MMT-Bench - Scene Recognition85Score (%)97.3
MEGA-Bench Task - MMSoc Memotion68.2Task Score (%)96.5
MEGA-Bench Task - Paper Review Acceptance60Task Score (%)96.5
OpenVLM MMT-Bench - Tech Engineering55.6Score (%)96.4
OpenVLM MMBench V1.1 EN - Image Topic98.9Accuracy (%)95.2
OpenVLM MMT-Bench - Animals Recognition100Score (%)94.9
MEGA-Bench Task - MVSA Sentiment Classification78.6Task Score (%)94.2
MEGA-Bench Task - Video Grounding Temporal40Task Score (%)94.2
OpenVLM MMT-Bench - Fashion Recognition85Score (%)94.2
OpenVLM MMBench V1.1 EN - Attribute Recognition96.6Accuracy (%)93.6

Interactive version: theaggregate.ai/model?slug=aquila-vl-2b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.