GPT-6 Sol (Medium): benchmark results

Provider: OpenAI. Access: API.

Unified ELO 1743 ± 1, rank #48 of 3363 rated models, from 59 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA GDP.pdf - Real Estate - Criterion Pass Rate79.65Criterion Pass Rate (%)99.4
AA-Omniscience Index - Software Engineering (SWE) - HTML76Omniscience Index96.3
AA-Omniscience Index - Software Engineering (SWE) - Java39Omniscience Index95.2
AutomationBench-AA - Sales - Raw Objective Completion86.52Raw Objective Completion (%)95.2
AA-Omniscience Index - Business22.5Omniscience Index95
AA-Omniscience Index - Software Engineering (SWE) - TypeScript76.67Omniscience Index94.4
Maze-Bench58.01Mean Score94.3
AA-Omniscience Index - Software Engineering (SWE) - Go68Omniscience Index94.2
AA-Omniscience Index - Software Engineering (SWE) - Python72Omniscience Index94.2
AA Long Context Reasoning82.33Accuracy (%)94.1
AA-Omniscience Index - Software Engineering (SWE) - Dart54Omniscience Index94.1
AA-Omniscience Index - Software Engineering (SWE) - PHP66Omniscience Index94.1

Interactive version: theaggregate.ai/model?slug=gpt-6-sol-medium · How It Works · Data refreshed daily, snapshot 2026-09-23.