ERNIE-4.5-21B-A3B (Thinking) — benchmark results

Baidu ERNIE 4.5 21B A3B evaluated with thinking enabled. Provider: Baidu. Released 2025-06-28. Access: Open.

Unified ELO 1439 ± 80, rank #1049 of 1776 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AI Chess Leaderboard (Reasoning)634Elo43.5
Wolfram LLM Benchmarking Project30.6Correct Functionality (%)36.9
SnakeBench18.4TrueSkill Rating34.1
OpenCompass Research - AIME 202576.2Score (%)34
OpenCompass Research - LiveCodeBench v647Score (%)19.1
OpenCompass57Average Score18.1
OpenCompass Research - HLE6.5Score (%)17
ReasonScape M12X106.43ReasonScore (hard)16.5
OpenCompass Research - IFEval81.2Score (%)10.6
LiveSecBench23.66Overall Score (%)9.5
OpenCompass Research - GPQA Diamond60.2Score (%)8.5
OpenCompass Research - MMLU-Pro70.8Score (%)6.4

Interactive version: theaggregate.ai/model?slug=ernie-4-5-21b-a3b-thinking · How the rankings work · Data refreshed daily, snapshot 2026-07-22.