InternVL2.5-2B — benchmark results

Provider: Shanghai AI Lab. Released 2024-12-06. Access: Open.

Unified ELO 1275 ± 10, rank #1581 of 1776 rated models, from 780 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MEGA-Bench Task - Bongard Problem81.6Task Score (%)100
MEGA-Bench Task - Paper Review Rating76.4Task Score (%)98.8
Open LMM Reasoning - WeMath - RoteMemorization (Strict)81.9Accuracy (%)95.1
Open LMM Reasoning - MathVision - topology34.8Accuracy (%)94.9
OpenVLM MMBench V1.1 EN - Social Relation91.2Accuracy (%)94.7
MEGA-Bench Task - CVBench Adapted CVBench Count71.4Task Score (%)94.2
OpenVLM MMBench V1.1 EN - Attribute Recognition96.6Accuracy (%)93.6
MEGA-Bench Task - Relative Reflectance Of Different Regions50Task Score (%)93
MEGA-Bench Task - NExT-QA MC94.7Task Score (%)91.9
OpenVLM MMBench V1.1 CN - Image Scene91Accuracy (%)91.2
MEGA-Bench Task - Symbolic Graphics Programs Scalable Vector Graphics16.7Task Score (%)88.4
Open LMM Reasoning - WeMath - InsufficientKnowledge (Loose)63.8Accuracy (%)87.7

Interactive version: theaggregate.ai/model?slug=internvl2-5-2b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.