GPT-4 Turbo (Preview): benchmark results
OpenAI preview GPT-4 Turbo model row, tracked separately from the GA GPT-4 Turbo row. Provider: OpenAI. Released 2023-11-06. Access: API.
Unified ELO 1540 ± 1, rank #482 of 1392 rated models, from 26 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| T-Eval | 86.4 | Overall Score (%) | 100 |
| InfiBench | 68.42 | Score (%) | 99 |
| Klu LLM Leaderboard | 100 | Klu Index | 98.8 |
| ENAMEL | 47 | eff@1 (self-reported) | 96.8 |
| Natural2Code | 51.5 | Score (self-reported) | 91.3 |
| EvalPlus (HumanEval+ & MBPP+) | 77.5 | Pass@1 avg (%) | 91.1 |
| LLM-AggreFact | 76.16 | Balanced Accuracy (%) | 89.5 |
| HELM NaturalQuestions (Open) | 76.29 | F1 (%) | 82.2 |
| HELM NaturalQuestions (Closed) | 43.47 | F1 (%) | 77.8 |
| SEAL - Korean | 60.76 | Score | 77.8 |
| HELM (Stanford) | 69.82 | Mean Win Rate (%) | 74.4 |
| SEAL - Math | 95.1 | Score | 73.3 |
Interactive version: theaggregate.ai/model?slug=gpt-4-turbo-preview · How It Works · Data refreshed daily, snapshot 2026-09-05.