h2o-danube3.1-4B-chat: benchmark results

Provider: H2O.ai. Access: Open.

Unified ELO 1408 ± 58, rank #1840 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval50.21Score59.3
Open LLM Leaderboard - MuSR41.02Score50.6
Open Portuguese LLM - FaQuAD NLI57.59Macro F1 (%)41
Open LLM Leaderboard - GPQA28.52Score40.2
Open Portuguese LLM - ENEM52.9Accuracy (%)36.3
Open Portuguese LLM - OAB Exams37.31Accuracy (%)35.4
Open Portuguese LLM - BLUEX39.08Accuracy (%)32.1
Open LLM Leaderboard - MMLU-Pro27.19Score29.2
Open Portuguese LLM - ASSIN2 RTE75.79Macro F1 (%)27.7
Open LLM Leaderboard - BBH36.08Score20.6
Open LLM Leaderboard - MATH Level 53.32Score20.2

Interactive version: theaggregate.ai/model?slug=h2o-danube3-1-4b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.