React Native Evals — leaderboard

Callstack React Native coding benchmark: 43 evals across navigation (13), animation (17), and async-state (13) testing mobile UI development with 1,630 requirements.

Metric: Overall Score (%). Source: rn-evals.vercel.app. Status: saturated. 26 models tracked.

Top models

#ModelScore
1Claude Fable 586.96
2GPT-5.6 Sol86.34
3Claude Opus 4.884.69
4GPT-5.584.65
5Grok 4.584.58
6GPT-5.6 Terra83.52
7GPT-5.6 Luna82.86
8Muse Spark 1.181.14
9Claude Sonnet 4.680.62
10Gemini 3.1 Pro (Preview)78.9
11MiniMax-M378.57
12GLM-5.278.36
13Kimi K2.677.69
14Gemini 3.5 Flash75.49
15Gemma 4 31B (IT)75.24

Interactive version: theaggregate.ai/benchmark?slug=react-native-evals · How the rankings work · Data refreshed daily, snapshot 2026-07-22.