GPT-4 Preview (0125): benchmark results

January 25, 2024 GPT-4 Turbo preview snapshot (gpt-4-0125-preview). Provider: OpenAI. Released 2024-01-25. Access: API.

Unified ELO 1558 ± 1, rank #410 of 1392 rated models, from 48 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BiGGen-Bench4.19Average Score (1-5)99
LogicKor - Single-Turn9.33Score (0-10)98.7
LogicKor - Reasoning9.35Score (0-10)97.7
LogicKor9.13Score (0-10)97.3
Enkrypt AI - Safety Risk15.97Risk Score95.4
LogicKor - Grammar8.21Score (0-10)95
MAGI-Hard76.83Accuracy (%, 2024-05 snapshot)94.8
LogicKor - Understanding9.78Score (0-10)94.7
LogicKor - Math8.21Score (0-10)94.3
LogicKor - Writing9.57Score (0-10)93.3
LogicKor - Multi-Turn8.92Score (0-10)92.9
BenchBench84.92Aggregate Score (%)92.6

Interactive version: theaggregate.ai/model?slug=gpt-4-preview-0125 · How It Works · Data refreshed daily, snapshot 2026-09-05.