LogiScope-VQA - Fine-Grained Perception (Cross-Instance): leaderboard

Metric: Micro-averaged accuracy (%). Source: arxiv.org. 20 models tracked.

Top models

#ModelScore
1Gemini 3.1 Pro (Preview)70
2GPT-5.568
3Qwen 3.5 Plus65
4Claude Sonnet 4.664
5Qwen 3.7 Plus64
6Claude Opus 4.761
7Kimi K2.660
8Qwen 3 VL 235B A22B59
9GPT-5.458
10Kimi K2 (Thinking)54
11MiniMax-M2.554
12MiniMax-M2.149
13GLM-5.245
14GLM-4.741

Interactive version: theaggregate.ai/benchmark?slug=logiscope-vqa-fine-grained-perception-cross-instance · How It Works · Data refreshed daily, snapshot 2026-09-19.