GPT-3.5 Turbo (1106): benchmark results

November 2023 GPT-3.5 Turbo API snapshot (gpt-3.5-turbo-1106). Provider: OpenAI. Released 2023-11-06. Access: API.

Unified ELO 1426 ± 1, rank #1043 of 1392 rated models, from 53 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Epoch AI - Adversarial Nli58.1Score95
T-Eval84Overall Score (%)95
ARC Challenge (AI2)87.4Accuracy (%)92.1
OpenBookQA86Accuracy (%)90.5
SpeechMap Compliance89.5% Requests Completed90.2
LogicKor - Grammar7.92Score (0-10)89.9
TriviaQA85.8Accuracy (%)87.2
VNTL Leaderboard69.98Accuracy (%)82.6
EvalPlus (HumanEval+ & MBPP+)70.2Pass@1 avg (%)81
LogicKor - Multi-Turn7.64Score (0-10)79
LogicKor7.71Score (0-10)77.5
LogicKor - Single-Turn7.78Score (0-10)77.3

Interactive version: theaggregate.ai/model?slug=gpt-3-5-turbo-1106 · How It Works · Data refreshed daily, snapshot 2026-09-05.