Ovis2-8B — benchmark results

AIDC-AI's (Alibaba) Ovis2 8B vision-language model pairing an AIMv2 vision encoder with Qwen2.5-7B-Instruct, strong on OCR, charts and video (February 2025). Provider: Alibaba. Released 2025-02-21. Access: Open.

Unified ELO 1466 ± 8, rank #926 of 1776 rated models, from 1008 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MEGA-Bench Task - Extract Webpage Headline85.7Task Score (%)100
MEGA-Bench Task - GUI Chat Easy77.7Task Score (%)100
MEGA-Bench Task - GUI Chat Hard70.4Task Score (%)100
MEGA-Bench Task - Remaining Playback Time Calculation35.7Task Score (%)100
OpenVLM MMT-Bench - Color Contrast90Score (%)100
OpenVLM MMT-Bench - Traffic Participants Understanding75Score (%)99.3
OpenVLM MMBench V1.1 CN - Function Reasoning96.7Accuracy (%)98.9
OpenVLM MMT-Bench - AUD69Score (%)98.8
OpenVLM MMT-Bench - Chart VQA85Score (%)98.8
OpenVLM MMBench V1.1 EN - Image Emotion84.4Accuracy (%)98.2
OpenVLM MMT-Bench - Multiple View Image Understanding50Score (%)98.1
OpenVLM MME - Code Reasoning185Score97.9

Interactive version: theaggregate.ai/model?slug=ovis2-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.