Hy3: benchmark results

Tencent's Hunyuan 3 open MoE model (295B total, 21B active), tuned for agentic tool calling and reasoning. Provider: Tencent. Released 2026-07-06. Access: Open.

Unified ELO 1691 ± 1, rank #65 of 1392 rated models, from 137 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Swift76Accuracy (%)99.3
Humanity's Last Exam (Self-Reported, No Tools)53.2Accuracy (%)98
Enkrypt AI - Risk Score15.15Risk Score97
AA Omniscience - Software Engineering (SWE) - PHP58Accuracy (%)96.8
AA Omniscience - Software Engineering (SWE) - Java37Accuracy (%)96.4
AA Omniscience - Software Engineering (SWE) - Python46.5Accuracy (%)96.2
AA Omniscience - Software Engineering (SWE) - HTML64Accuracy (%)95.7
AA Omniscience - Software Engineering (SWE) - TypeScript53.33Accuracy (%)95.2
AA Omniscience - Software Engineering (SWE) - Rust74Accuracy (%)95.1
AA Omniscience - Software Engineering (SWE) - Dart40Accuracy (%)94.5
AA Omniscience - Software Engineering (SWE) - Kotlin44Accuracy (%)94.5
AA Omniscience - Software Engineering (SWE) - Go42Accuracy (%)94

Interactive version: theaggregate.ai/model?slug=hy3 · How It Works · Data refreshed daily, snapshot 2026-09-05.