GPT-4 Preview (0125) — benchmark results

January 25, 2024 GPT-4 Turbo preview snapshot (gpt-4-0125-preview). Provider: OpenAI. Released 2024-01-25. Access: API.

Unified ELO 1624 ± 20, rank #429 of 1776 rated models, from 41 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LiveBench Table Reformat70Score100
LogicKor - Math9.57Score (0-10)100
LogicKor - Reasoning9.64Score (0-10)99.6
LogicKor - Single-Turn9.35Score (0-10)99.1
BiGGen-Bench4.19Average Score (1-5)99
LogicKor9.29Score (0-10)98.9
LogicKor - Multi-Turn9.23Score (0-10)98.7
LogicKor - Writing9.71Score (0-10)97.6
LogicKor - Grammar8.42Score (0-10)97.3
LogicKor - Coding9.78Score (0-10)96
LiveBench Zebra Puzzle44Score95.8
LogicKor - Understanding9.78Score (0-10)95.1

Interactive version: theaggregate.ai/model?slug=gpt-4-preview-0125 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.