GPT-6.1 Sol (Low): benchmark results

Provider: OpenAI. Released 2026-09-29. Access: API.

Unified ELO 1805 ± 17, rank #22 of 2066 rated models, from 74 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EnigmaForge84.5Task success (%) over 600 procedurally generated story insta100
EnigmaForge - Fact F198.5World-fact recovery F1 (%) over 600 instances, all items100
EnigmaForge - Intuition83.8Task success (%) on implicit-condition instances, where the 100
AA-Omniscience Index - Software Engineering (SWE) - HTML92Omniscience Index99.7
AA-Omniscience Index - Software Engineering (SWE) - Rust86Omniscience Index98.9
AA-Omniscience Index - Software Engineering (SWE) - TypeScript93.33Omniscience Index98.8
AA Long Context Reasoning84Accuracy (%)98
AA-Omniscience Index - Software Engineering (SWE) - Julia84Omniscience Index98
AA-Omniscience Index - Software Engineering (SWE) - Java68Omniscience Index97.9
AA-Omniscience Index - Business29.9Omniscience Index97.6
AA-Omniscience Index - Software Engineering (SWE) - Python84.5Omniscience Index97.2
AA-Omniscience Index - Software Engineering (SWE) - JavaScript81.82Omniscience Index97.1

Interactive version: theaggregate.ai/model?slug=gpt-6-1-sol-low · How It Works · Data refreshed daily, snapshot 2026-10-01.