h2o-danube3-4B-chat: benchmark results

Provider: H2O.ai. Access: Open.

Unified ELO 1369 ± 1, rank #1223 of 1392 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Enkrypt AI - Jailbreak Risk6.71Risk Score65.5
Open LLM Leaderboard - IFEval36.29Score34.8
Enkrypt AI - Toxicity Risk5.91Risk Score29.4
Open LLM Leaderboard - MuSR5.23Score25.7
Open LLM Leaderboard - MATH Level 54.08Score23.5
Open LLM Leaderboard - MMLU-Pro13.65Score23.1
Enkrypt AI - Safety Risk35.47Risk Score19.5
Open LLM Leaderboard - BBH8.84Score18.6
Open LLM Leaderboard - GPQA1.34Score13.2
Enkrypt AI - Risk Score49.43Risk Score8.7
Enkrypt AI - Insecure Code Risk81.78Risk Score6.4
Enkrypt AI - Bias Risk93.02Risk Score6.2

Interactive version: theaggregate.ai/model?slug=h2o-danube3-4b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.