GPT-4 Preview (0125) — benchmark results
January 25, 2024 GPT-4 Turbo preview snapshot (gpt-4-0125-preview). Provider: OpenAI. Released 2024-01-25. Access: API.
Unified ELO 1624 ± 20, rank #429 of 1776 rated models, from 41 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LiveBench Table Reformat | 70 | Score | 100 |
| LogicKor - Math | 9.57 | Score (0-10) | 100 |
| LogicKor - Reasoning | 9.64 | Score (0-10) | 99.6 |
| LogicKor - Single-Turn | 9.35 | Score (0-10) | 99.1 |
| BiGGen-Bench | 4.19 | Average Score (1-5) | 99 |
| LogicKor | 9.29 | Score (0-10) | 98.9 |
| LogicKor - Multi-Turn | 9.23 | Score (0-10) | 98.7 |
| LogicKor - Writing | 9.71 | Score (0-10) | 97.6 |
| LogicKor - Grammar | 8.42 | Score (0-10) | 97.3 |
| LogicKor - Coding | 9.78 | Score (0-10) | 96 |
| LiveBench Zebra Puzzle | 44 | Score | 95.8 |
| LogicKor - Understanding | 9.78 | Score (0-10) | 95.1 |
Interactive version: theaggregate.ai/model?slug=gpt-4-preview-0125 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.