AI for Education Visual Reasoning - match (process) — leaderboard

Metric: Accuracy (%). Source: www.fab-ai.org. 64 models tracked.

Top models

#ModelScore
1GPT-5.6 Sol88.9
2Gemini 3 Flash77.8
3GPT-5.575
4Gemini 3.5 Flash75
5Qwen 3.6 Plus66.7
6GPT-5.4 (Medium)63.9
7GPT-5.461.1
8Qwen 3.5 397B A17B61.1
9Gemini 3 Pro58.3
10GPT-5.4 Mini (Medium)55.6
11GPT-5.2 (Medium)55.6
12Gemini 2.5 Pro52.8
13qwen3.5-flash52.8
14Qwen 3.5 Plus52.8
15Qwen 3.6 35B A3B50

Interactive version: theaggregate.ai/benchmark?slug=ai-for-education-visual-reasoning-match-process · How the rankings work · Data refreshed daily, snapshot 2026-07-22.