ERNIE 5.0 Thinking Preview — benchmark results

Baidu's extended-thinking preview variant of the multimodal ERNIE 5.0 flagship. Provider: Baidu. Released 2026-01-01. Access: API.

Unified ELO 1694 ± 32, rank #282 of 1776 rated models, from 43 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA LiveCodeBench81.16Pass@1 (%)93.3
AA Global-MMLU-Lite - English92.75Accuracy (%)83.2
AA MMLU-Pro83.03Accuracy (%)83.1
AA AIME 202585Accuracy (%)82.8
CritPt1.4Accuracy (self-reported)80.1
AA CritPt1.43Accuracy (%)75.1
AA TAU-2 Bench83.92Accuracy (%)74.8
AA Global-MMLU-Lite86.5Accuracy (%)73.1
AA Humanity's Last Exam12.65Accuracy (%)69.4
AA GPQA Diamond77.68Accuracy (%)68.4
AA Omniscience - Software Engineering (SWE) - R20Accuracy (%)66.6
AA Terminal-Bench Hard25Accuracy (%)66

Interactive version: theaggregate.ai/model?slug=ernie-5-0-thinking-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.