GPT-3.5 Turbo (1106) — benchmark results
November 2023 GPT-3.5 Turbo API snapshot (gpt-3.5-turbo-1106). Provider: OpenAI. Released 2023-11-06. Access: API.
Unified ELO 1460 ± 27, rank #957 of 1776 rated models, from 35 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| T-Eval | 84 | Overall Score (%) | 95 |
| OpenBookQA | 86 | Accuracy (%) | 92.9 |
| ARC Challenge (AI2) | 87.4 | Accuracy (%) | 91 |
| LogicKor - Grammar | 7.92 | Score (0-10) | 90.7 |
| SpeechMap Compliance | 89.5 | % Requests Completed | 89.1 |
| LogicKor - Math | 7.57 | Score (0-10) | 88.1 |
| TriviaQA | 85.8 | Accuracy (%) | 87.2 |
| Epoch AI - Adversarial Nli | 58.1 | Score | 86.4 |
| LogicKor - Multi-Turn | 7.88 | Score (0-10) | 83.4 |
| LogicKor | 7.79 | Score (0-10) | 83.2 |
| VNTL Leaderboard | 69.98 | Accuracy (%) | 82.6 |
| LogicKor - Coding | 9.07 | Score (0-10) | 82.3 |
Interactive version: theaggregate.ai/model?slug=gpt-3-5-turbo-1106 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.