Hy3-preview (Reasoning): benchmark results

Tencent Hunyuan Hy3 preview (295B A21B open MoE) evaluated with reasoning enabled. Provider: Tencent. Released 2026-04-24. Access: Open.

Unified ELO 1619 ± 1, rank #359 of 1761 rated models, from 43 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLMEval-Logic Base75.3Accuracy (%)92.3
UGI - Natural Intelligence50.11NatInt Score90.3
UGI - Writing51.12Writing Score88.8
AA Omniscience - Software Engineering (SWE) - R30Accuracy (%)88.7
AA Omniscience - Software Engineering (SWE) - JavaScript46.36Accuracy (%)88.4
AA TAU-2 Bench92.69Accuracy (%)88.3
AA Omniscience - Software Engineering (SWE) - Swift52Accuracy (%)86.7
AA Omniscience - Software Engineering (SWE) - Rust64Accuracy (%)86.5
AA Omniscience - Software Engineering (SWE) - Dart30Accuracy (%)85.2
AA Omniscience - Software Engineering (SWE) - Kotlin30Accuracy (%)84.1
Wolfram LLM Benchmarking Project56.7Correct Functionality (%)83.7
AA Omniscience - Software Engineering (SWE) - Python32.5Accuracy (%)83.4

Interactive version: theaggregate.ai/model?slug=hy3-preview-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.