GPT-3.5 Turbo (0125) — benchmark results

January 25, 2024 GPT-3.5 Turbo API snapshot (gpt-3.5-turbo-0125). Provider: OpenAI. Released 2024-01-25. Access: API.

Unified ELO 1455 ± 19, rank #973 of 1776 rated models, from 84 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SpeechMap Compliance94.5% Requests Completed96.7
LogicKor - Grammar8Score (0-10)91.4
LogicKor - Coding9.42Score (0-10)90.7
LogicKor - Understanding9.57Score (0-10)88.9
LogicKor - Single-Turn8.19Score (0-10)84.3
LogicKor - Math6.92Score (0-10)83.4
LogicKor - Multi-Turn7.88Score (0-10)83.4
LogicKor7.78Score (0-10)82.3
Compl-AI Board76.99Average Compliance Score (%)78.6
BiGGen-Bench3.69Average Score (1-5)77.5
LogicKor - Reasoning7.07Score (0-10)75.4
HELM EWoK - Physical Dynamics87.33EM71.4

Interactive version: theaggregate.ai/model?slug=gpt-3-5-turbo-0125 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.