GPT-5.1 (Low) — benchmark results

GPT-5.1 evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2025-11-12. Access: API.

Unified ELO 1711 ± 23, rank #255 of 1776 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence61.99NatInt Score95.4
UGI - Writing50.84Writing Score89.2
LLM Chess (Saplin)614.7ELO85
UGI Leaderboard44.15UGI Score77.9
Epoch AI - ECI149.74ECI Score73.9
Design Arena (Data Viz)1241Elo73.6
Design Arena (Game Dev)1209Elo57.9
FrontierMath - Tiers 1-317.3Accuracy (%, 290 problems)54.5
Design Arena (Website)1199Elo53.8
Design Arena (UI Components)1195Elo50.7
OTIS Mock AIME 2024-2563.89Accuracy (%)50.3
Design Arena (SVG)1165Elo45.5

Interactive version: theaggregate.ai/model?slug=gpt-5-1-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.