Ovis2-8B — benchmark results
AIDC-AI's (Alibaba) Ovis2 8B vision-language model pairing an AIMv2 vision encoder with Qwen2.5-7B-Instruct, strong on OCR, charts and video (February 2025). Provider: Alibaba. Released 2025-02-21. Access: Open.
Unified ELO 1466 ± 8, rank #926 of 1776 rated models, from 1008 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MEGA-Bench Task - Extract Webpage Headline | 85.7 | Task Score (%) | 100 |
| MEGA-Bench Task - GUI Chat Easy | 77.7 | Task Score (%) | 100 |
| MEGA-Bench Task - GUI Chat Hard | 70.4 | Task Score (%) | 100 |
| MEGA-Bench Task - Remaining Playback Time Calculation | 35.7 | Task Score (%) | 100 |
| OpenVLM MMT-Bench - Color Contrast | 90 | Score (%) | 100 |
| OpenVLM MMT-Bench - Traffic Participants Understanding | 75 | Score (%) | 99.3 |
| OpenVLM MMBench V1.1 CN - Function Reasoning | 96.7 | Accuracy (%) | 98.9 |
| OpenVLM MMT-Bench - AUD | 69 | Score (%) | 98.8 |
| OpenVLM MMT-Bench - Chart VQA | 85 | Score (%) | 98.8 |
| OpenVLM MMBench V1.1 EN - Image Emotion | 84.4 | Accuracy (%) | 98.2 |
| OpenVLM MMT-Bench - Multiple View Image Understanding | 50 | Score (%) | 98.1 |
| OpenVLM MME - Code Reasoning | 185 | Score | 97.9 |
Interactive version: theaggregate.ai/model?slug=ovis2-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.