ERNIE-4.5-21B-A3B (Thinking) — benchmark results
Baidu ERNIE 4.5 21B A3B evaluated with thinking enabled. Provider: Baidu. Released 2025-06-28. Access: Open.
Unified ELO 1439 ± 80, rank #1049 of 1776 rated models, from 12 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AI Chess Leaderboard (Reasoning) | 634 | Elo | 43.5 |
| Wolfram LLM Benchmarking Project | 30.6 | Correct Functionality (%) | 36.9 |
| SnakeBench | 18.4 | TrueSkill Rating | 34.1 |
| OpenCompass Research - AIME 2025 | 76.2 | Score (%) | 34 |
| OpenCompass Research - LiveCodeBench v6 | 47 | Score (%) | 19.1 |
| OpenCompass | 57 | Average Score | 18.1 |
| OpenCompass Research - HLE | 6.5 | Score (%) | 17 |
| ReasonScape M12X | 106.43 | ReasonScore (hard) | 16.5 |
| OpenCompass Research - IFEval | 81.2 | Score (%) | 10.6 |
| LiveSecBench | 23.66 | Overall Score (%) | 9.5 |
| OpenCompass Research - GPQA Diamond | 60.2 | Score (%) | 8.5 |
| OpenCompass Research - MMLU-Pro | 70.8 | Score (%) | 6.4 |
Interactive version: theaggregate.ai/model?slug=ernie-4-5-21b-a3b-thinking · How the rankings work · Data refreshed daily, snapshot 2026-07-22.