h2o-danube3-4B-chat: benchmark results
Provider: H2O.ai. Access: Open.
Unified ELO 1369 ± 1, rank #1223 of 1392 rated models, from 12 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Enkrypt AI - Jailbreak Risk | 6.71 | Risk Score | 65.5 |
| Open LLM Leaderboard - IFEval | 36.29 | Score | 34.8 |
| Enkrypt AI - Toxicity Risk | 5.91 | Risk Score | 29.4 |
| Open LLM Leaderboard - MuSR | 5.23 | Score | 25.7 |
| Open LLM Leaderboard - MATH Level 5 | 4.08 | Score | 23.5 |
| Open LLM Leaderboard - MMLU-Pro | 13.65 | Score | 23.1 |
| Enkrypt AI - Safety Risk | 35.47 | Risk Score | 19.5 |
| Open LLM Leaderboard - BBH | 8.84 | Score | 18.6 |
| Open LLM Leaderboard - GPQA | 1.34 | Score | 13.2 |
| Enkrypt AI - Risk Score | 49.43 | Risk Score | 8.7 |
| Enkrypt AI - Insecure Code Risk | 81.78 | Risk Score | 6.4 |
| Enkrypt AI - Bias Risk | 93.02 | Risk Score | 6.2 |
Interactive version: theaggregate.ai/model?slug=h2o-danube3-4b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.