ERNIE 5.0 — benchmark results

Baidu's proprietary multimodal ERNIE 5.0 flagship (November 2025). Provider: Baidu. Released 2025-11-13. Access: API.

Unified ELO 1609 ± 41, rank #462 of 1776 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ZeroEval GPQA Diamond85GPQA Diamond Score77
LLM2014 Logic 2026-0141.43Median Score63.6
OpenCompass Agent - Multi-Turn75.2Score (%)62
LLM2014 Logic 2025-1140.69Median Score57.7
LLM2014 Logic 2026-0234.53Median Score48.9
LLM2014 Logic 2025-1236.1Median Score44
Position Bias (Lechmazur)45Order Flip % (lower is better)40
LLM2014 Logic 2026-0332.15Median Score36.6
OpenCompass Code - Competition41.8Score (%)36
OpenCompass Language - Dialogue94.1Score (%)36
LLM2014 Logic 2026-0428.37Median Score27.5
Sycophancy (Lechmazur)8Sycophancy rate % (lower is better)27.4

Interactive version: theaggregate.ai/model?slug=ernie-5-0 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.