h2o-danube3-4B-base — benchmark results

Provider: H2O.ai. Released 2024-07-04. Access: Open.

Unified ELO 1303 ± 45, rank #1529 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA5.48Score46
Open LLM Leaderboard - MuSR6.53Score31.1
Open PL LLM - Generative31.61Average Generative Score (%)31.1
Open PL LLM - RAG38.42Average RAG Score (%)25.9
Open PL LLM Leaderboard12.72Average Score (%)23.1
Open LLM Leaderboard - MMLU-Pro12.33Score22.2
Open LLM Leaderboard - BBH10.56Score20.4
Open LLM Leaderboard - IFEval23.38Score17
Open LLM Leaderboard - MATH Level 52.27Score15.4
Open PL LLM - Multiple Choice-11.84Average Multiple-Choice Score (%)11.2

Interactive version: theaggregate.ai/model?slug=h2o-danube3-4b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.