React Native Evals: leaderboard

Callstack React Native coding benchmark: 43 evals across navigation (13), animation (17), and async-state (13) testing mobile UI development with 1,630 requirements.

Metric: Overall Score (%). Source: rn-evals.vercel.app. Status: saturation imminent. 25 models tracked.

Top models

#ModelScore
1Claude Opus 588.11
2Claude Fable 586.96
3GPT-5.6 Sol86.34
4Claude Opus 4.884.69
5GPT-5.584.65
6Grok 4.584.58
7Grok 4.684.07
8GPT-5.6 Terra83.52
9GPT-5.6 Luna82.86
10GLM-5.3 Flash81.43
11Muse Spark 1.181.14
12Claude Sonnet 4.680.62
13Gemini 3.1 Pro (Preview)78.9
14MiniMax-M378.57
15GLM-5.278.36

Interactive version: theaggregate.ai/benchmark?slug=react-native-evals · How It Works · Data refreshed daily, snapshot 2026-09-05.