MirrorCode: leaderboard

Epoch AI coding benchmark where models reimplement whole open-source programs from observed behavior rather than copying the original source. Reports per-target mean solve rates across program-reconstruction tasks.

Metric: Solve@100 Rate (%). Source: epoch.ai. 6 models tracked.

Top models

#ModelScore
1Claude Fable 563.9
2Claude Opus 4.731.1
3GPT-5.6 Sol20
4GPT-5.415.6
5GPT-5.510
6Gemini 3.1 Pro (Preview)8.9

Interactive version: theaggregate.ai/benchmark?slug=mirrorcode · How It Works · Data refreshed daily, snapshot 2026-09-05.