GPT-3.5 Turbo (1106): benchmark results
November 2023 GPT-3.5 Turbo API snapshot (gpt-3.5-turbo-1106). Provider: OpenAI. Released 2023-11-06. Access: API.
Unified ELO 1426 ± 1, rank #1043 of 1392 rated models, from 53 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Epoch AI - Adversarial Nli | 58.1 | Score | 95 |
| T-Eval | 84 | Overall Score (%) | 95 |
| ARC Challenge (AI2) | 87.4 | Accuracy (%) | 92.1 |
| OpenBookQA | 86 | Accuracy (%) | 90.5 |
| SpeechMap Compliance | 89.5 | % Requests Completed | 90.2 |
| LogicKor - Grammar | 7.92 | Score (0-10) | 89.9 |
| TriviaQA | 85.8 | Accuracy (%) | 87.2 |
| VNTL Leaderboard | 69.98 | Accuracy (%) | 82.6 |
| EvalPlus (HumanEval+ & MBPP+) | 70.2 | Pass@1 avg (%) | 81 |
| LogicKor - Multi-Turn | 7.64 | Score (0-10) | 79 |
| LogicKor | 7.71 | Score (0-10) | 77.5 |
| LogicKor - Single-Turn | 7.78 | Score (0-10) | 77.3 |
Interactive version: theaggregate.ai/model?slug=gpt-3-5-turbo-1106 · How It Works · Data refreshed daily, snapshot 2026-09-05.