GPT-3.5 Turbo (0125): benchmark results
January 25, 2024 GPT-3.5 Turbo API snapshot (gpt-3.5-turbo-0125). Provider: OpenAI. Released 2024-01-25. Access: API.
Unified ELO 1412 ± 1, rank #1092 of 1392 rated models, from 93 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SpeechMap Compliance | 94.5 | % Requests Completed | 96.8 |
| LogicKor - Grammar | 8 | Score (0-10) | 90.5 |
| LogicKor - Understanding | 9.57 | Score (0-10) | 88 |
| ToolSandbox | 65.6 | Avg Score (self-reported) | 83.3 |
| LogicKor - Multi-Turn | 7.88 | Score (0-10) | 80.9 |
| LogicKor | 7.76 | Score (0-10) | 78.8 |
| Compl-AI Board | 76.99 | Average Compliance Score (%) | 78.6 |
| BiGGen-Bench | 3.69 | Average Score (1-5) | 77.5 |
| LogicKor - Coding | 8.92 | Score (0-10) | 77.3 |
| LogicKor - Single-Turn | 7.64 | Score (0-10) | 72.3 |
| HELM EWoK - Physical Dynamics | 87.33 | EM | 71.4 |
| HELM Finance - FinanceBench | 60 | Correct Answer | 71.4 |
Interactive version: theaggregate.ai/model?slug=gpt-3-5-turbo-0125 · How It Works · Data refreshed daily, snapshot 2026-09-05.