MultiView-Bench - 3D Real World: leaderboard

Metric: Accuracy (%; six views of 3DCoMPaT++ real-world object assets; fraction of 100 procedurally generated Blender scenes whose relative position of a target object is answered exactly as (+/-X or 0, +/-Y or 0, +/-Z or 0) in a visible world coordinate frame; mean over three runs where printed (Claude 3.7 Sonnet one run); x100). Source: arxiv.org. Saturation forecast: Around December 2026. 15 models tracked.

Top models

#ModelScore
1GPT-5.6 Sol (Medium)60
2GPT-5.6 Luna (Medium)60
3GPT-556.7
4O348.5
5Gemini 3.1 Pro (Preview) (Medium)46.7
6GPT-5.6 Terra (Medium)46
7Gemini 3.5 Flash (Medium)33.3
8Claude Haiku 4.5 (Thinking)14.7
9Gemini 2.5 Pro12
10Gemini 2.5 Flash10.7
11Claude Sonnet 47.3
12Claude 3.7 Sonnet6
13GPT-4o3.3

Interactive version: theaggregate.ai/benchmark?slug=multiview-bench-3d-real-world · How It Works · Data refreshed daily, snapshot 2026-09-29.