GPT-6 Sol (High): benchmark results
Provider: OpenAI. Access: API.
Unified ELO 1755 ± 1, rank #32 of 3363 rated models, from 60 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA GDP.pdf - Real Estate - Criterion Pass Rate | 79.84 | Criterion Pass Rate (%) | 100 |
| Next.js Agent Evals (Codex) - Success Rate | 97 | Evals passed, pass@4 (%) | 100 |
| AA-Omniscience Index - Software Engineering (SWE) - HTML | 84 | Omniscience Index | 98.1 |
| AA Long Context Reasoning | 83.67 | Accuracy (%) | 97.3 |
| AA-Omniscience Index - Software Engineering (SWE) - Rust | 80 | Omniscience Index | 97.3 |
| AutomationBench-AA - Sales - Raw Objective Completion | 86.84 | Raw Objective Completion (%) | 96.8 |
| AA GDP.pdf | 28 | All Criteria Pass Rate (%) | 96.3 |
| AA-Omniscience Index - Software Engineering (SWE) - TypeScript | 82.22 | Omniscience Index | 95.8 |
| AA GDP.pdf - Construction - Criterion Pass Rate | 76.17 | Criterion Pass Rate (%) | 95.5 |
| AA-Omniscience Index - Business | 22.8 | Omniscience Index | 95.4 |
| AutomationBench-AA - HR - Raw Objective Completion | 75.57 | Raw Objective Completion (%) | 95.2 |
| AA-Omniscience Index - Software Engineering (SWE) - JavaScript | 71.82 | Omniscience Index | 94.7 |
Interactive version: theaggregate.ai/model?slug=gpt-6-sol-high · How It Works · Data refreshed daily, snapshot 2026-09-23.