GPT-6 Sol: benchmark results

Provider: OpenAI. Access: API.

Unified ELO 2088 ± 17, rank #11 of 2928 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BenchLM80.5Overall Score97.5
RuneBench13372Total Peak XP Rate (XP/min)96.5
LLM Stats (Agents' Last Exam)56.4Score (%)95
LLM Stats Score49.39LLM Stats Score (conservative rating)94.6
SvelteBench100Average pass@1 (%)94.6
AI Chess Leaderboard (Continuation)1195Elo85.6
AI Chess Leaderboard (Reasoning)1072Elo80.5
LLM Stats (FrontierCode 1.1)49.3Score (%)78.9
ParseBench68.19Overall Score77.8
LLM Stats (DeepSWE 1.1)68.8Score (%)68.9
LLM Stats (OSWorld 2.0)64.4Score (%)61.5
TaxCalcBench26Correct Returns - Strict (%)53.6

Interactive version: theaggregate.ai/model?slug=gpt-6-sol · How It Works · Data refreshed daily, snapshot 2026-09-23.