GPT-6 Sol (High): benchmark results

Provider: OpenAI. Access: API.

Unified ELO 1755 ± 1, rank #32 of 3363 rated models, from 60 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA GDP.pdf - Real Estate - Criterion Pass Rate79.84Criterion Pass Rate (%)100
Next.js Agent Evals (Codex) - Success Rate97Evals passed, pass@4 (%)100
AA-Omniscience Index - Software Engineering (SWE) - HTML84Omniscience Index98.1
AA Long Context Reasoning83.67Accuracy (%)97.3
AA-Omniscience Index - Software Engineering (SWE) - Rust80Omniscience Index97.3
AutomationBench-AA - Sales - Raw Objective Completion86.84Raw Objective Completion (%)96.8
AA GDP.pdf28All Criteria Pass Rate (%)96.3
AA-Omniscience Index - Software Engineering (SWE) - TypeScript82.22Omniscience Index95.8
AA GDP.pdf - Construction - Criterion Pass Rate76.17Criterion Pass Rate (%)95.5
AA-Omniscience Index - Business22.8Omniscience Index95.4
AutomationBench-AA - HR - Raw Objective Completion75.57Raw Objective Completion (%)95.2
AA-Omniscience Index - Software Engineering (SWE) - JavaScript71.82Omniscience Index94.7

Interactive version: theaggregate.ai/model?slug=gpt-6-sol-high · How It Works · Data refreshed daily, snapshot 2026-09-23.