Qwen 2 VL 7B Instruct — benchmark results
Alibaba's Apache-2.0 7B vision-language model (August 2024) handling image, multi-image, and video input. Provider: Alibaba. Released 2024-08-29. Access: Open.
Unified ELO 1439 ± 13, rank #1046 of 1776 rated models, from 83 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| TempCompass | 67.8 | Avg All (%) | 85.7 |
| Open LLM Leaderboard - GPQA | 9.28 | Score | 74.8 |
| Open LLM Leaderboard - MMLU-Pro | 34.39 | Score | 74.6 |
| Open LLM Leaderboard - MuSR | 13.55 | Score | 74.6 |
| Open LLM Leaderboard - BBH | 35.88 | Score | 73 |
| Open LLM Leaderboard - MATH Level 5 | 19.86 | Score | 70.7 |
| KOFFVQA - Korean Recognition | 40 | Score (%) | 66.7 |
| KOFFVQA - Document Understanding | 64.33 | Score (%) | 60.5 |
| KOFFVQA - Object Attributes | 73.17 | Score (%) | 57.4 |
| Open Japanese LLM - CG | 20.28 | Score (%) | 55.8 |
| Open Japanese LLM - Mbpp Pylint Check | 40.16 | Score (%) | 54.6 |
| KOFFVQA - Korean OCR | 70 | Score (%) | 53.1 |
Interactive version: theaggregate.ai/model?slug=qwen-2-vl-7b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.