GeoRC — leaderboard

Geolocation reasoning benchmark for vision-language models, measuring location inference, F1, and country-level accuracy.

Metric: F1 (self-reported). Source: benchmarklist.com. Status: saturation imminent. 15 models tracked.

Top models

#ModelScore
1GPT-4.142.3
2Gemini 2.5 Pro41.51
3Gemini 2.5 Flash41.3
4GPT-540.56
5Qwen 2.5 VL 7B Instruct31.63
6Gemma 3 12B31.21
7Llama 3.2 11B Vision Instruct25.86
8Qwen 3 VL 8B Instruct23.81

Interactive version: theaggregate.ai/benchmark?slug=georc · How the rankings work · Data refreshed daily, snapshot 2026-07-22.