OpenVLM Video - MMBench-Video - Relation Reasoning: leaderboard

Metric: GPT-4 Rating (0-3). Source: huggingface.co. 45 models tracked.

Top models

#ModelScore
1InternVL2.5-78B2.18
2GPT-4o (2024-08-06)2.17
3Gemini 1.5 Pro1.92
4Gemini 2.0 Flash1.84
5InternVL3-78B1.84
6InternVL3-8B1.83
7Gemini 1.5 Flash1.78
8Qwen 2 VL 7B1.52
9Qwen 2 VL 72B1.5
10Claude 3.5 Sonnet1.48
11InternVL2-8B1.38
12Phi-4 Multimodal Instruct1.19

Interactive version: theaggregate.ai/benchmark?slug=openvlm-video-mmbench-video-relation-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.