SpatialGen-Bench (Visual Answering) — leaderboard
Metric: Overall Accuracy (%). Source: zju-omniai.github.io. 11 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | GPT-5 Image 2 | 48.13 |
| 2 | Nano Banana 2 | 43.58 |
| 3 | GPT-5 Image Mini | 36.92 |
| 4 | Seedream 4.5 | 33.72 |
| 5 | SenseNova-Vision-7B-MoT | 33.34 |
| 6 | FLUX.2 [klein] 9B | 31.54 |
| 7 | JoyAI-Image | 29.76 |
| 8 | OmniGen-v1 | 29.51 |
| 9 | FLUX.2 [klein] 4B | 25.63 |
| 10 | Qwen-Image-Edit-2511 | 22.88 |
Interactive version: theaggregate.ai/benchmark?slug=spatialgen-bench-visual-answering · How It Works · Data refreshed daily, snapshot 2026-07-26.