GPT-3.5 Turbo (0125): benchmark results

January 25, 2024 GPT-3.5 Turbo API snapshot (gpt-3.5-turbo-0125). Provider: OpenAI. Released 2024-01-25. Access: API.

Unified ELO 1412 ± 1, rank #1092 of 1392 rated models, from 93 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SpeechMap Compliance94.5% Requests Completed96.8
LogicKor - Grammar8Score (0-10)90.5
LogicKor - Understanding9.57Score (0-10)88
ToolSandbox65.6Avg Score (self-reported)83.3
LogicKor - Multi-Turn7.88Score (0-10)80.9
LogicKor7.76Score (0-10)78.8
Compl-AI Board76.99Average Compliance Score (%)78.6
BiGGen-Bench3.69Average Score (1-5)77.5
LogicKor - Coding8.92Score (0-10)77.3
LogicKor - Single-Turn7.64Score (0-10)72.3
HELM EWoK - Physical Dynamics87.33EM71.4
HELM Finance - FinanceBench60Correct Answer71.4

Interactive version: theaggregate.ai/model?slug=gpt-3-5-turbo-0125 · How It Works · Data refreshed daily, snapshot 2026-09-05.