MultiPL-E: leaderboard
MultiPL-E: Measures model capability on programming, code generation, code repair, or repository-level software tasks.
Source: arxiv.org.
Interactive version: theaggregate.ai/benchmark?slug=multipl-e · How It Works · Data refreshed daily, snapshot 2026-09-05.