h2o-danube3-4B-base — benchmark results
Provider: H2O.ai. Released 2024-07-04. Access: Open.
Unified ELO 1303 ± 45, rank #1529 of 1776 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - GPQA | 5.48 | Score | 46 |
| Open LLM Leaderboard - MuSR | 6.53 | Score | 31.1 |
| Open PL LLM - Generative | 31.61 | Average Generative Score (%) | 31.1 |
| Open PL LLM - RAG | 38.42 | Average RAG Score (%) | 25.9 |
| Open PL LLM Leaderboard | 12.72 | Average Score (%) | 23.1 |
| Open LLM Leaderboard - MMLU-Pro | 12.33 | Score | 22.2 |
| Open LLM Leaderboard - BBH | 10.56 | Score | 20.4 |
| Open LLM Leaderboard - IFEval | 23.38 | Score | 17 |
| Open LLM Leaderboard - MATH Level 5 | 2.27 | Score | 15.4 |
| Open PL LLM - Multiple Choice | -11.84 | Average Multiple-Choice Score (%) | 11.2 |
Interactive version: theaggregate.ai/model?slug=h2o-danube3-4b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.