ENC-Bench - Anchorage Selection: leaderboard

Metric: Accuracy (%) on ENC-Bench's 423 anchorage selection questions (Decision-Making: choosing the nearest safe anchorage among four candidates in an emergency; four options), on ENC-Bench's 840 NOAA S-57 electronic navigational charts rendered with OpenCPN in day, dusk and night palettes at six scales, zero-shot; higher is better. Source: arxiv.org. Saturation forecast: Around October 2027. 10 models tracked.

Top models

#ModelScoreOverall rank
1Qwen 3 VL 235B A22B (Thinking)30.5#228 (Qwen 3 VL 235B A22B)
2Gemini 2.5 Pro29.55#145
3Qwen 3 VL 235B A22B Instruct26.48#264
4GLM-4.5V26.24#339
5Gemini 2.5 Flash24.35#237
6GPT-4o20.57#333
7InternVL3-38B20.57#395
8Qwen 3 VL 32B (Thinking)18.44#287 (Qwen 3 VL 32B)
9Qwen 3 VL 32B Instruct17.26#276
10Llama 4 Maverick Instruct14.89#439

No result here: #3 Claude Opus 5.5, #5 GPT-6 Astra, #8 Claude Fable 5.1.

Interactive version: theaggregate.ai/benchmark?slug=enc-bench-anchorage-selection · How It Works · Data refreshed daily, snapshot 2026-10-11.