h2o-danube-1.8B-sft: benchmark results

Provider: H2O.ai. Access: Open.

Unified ELO 1297 ± 22, rank #2704 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K15.09Accuracy (%) (5-shot)37.1
Open Portuguese LLM - ASSIN2 RTE60.37Macro F1 (%)21.2
Open Portuguese LLM - ENEM23.58Accuracy (%)20.1
Open LLM Leaderboard v1 - WinoGrande65.43Accuracy (%) (5-shot)18.9
Open LLM Leaderboard v1 - HellaSwag67.34Normalized accuracy (%) (10-shot)18.4
Open LLM Leaderboard v1 - MMLU33.75Accuracy (%) (5-shot)17.8
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open LLM Leaderboard v1 - ARC Challenge40.19Normalized accuracy (%) (25-shot)16.5
Open LLM Leaderboard v1 - TruthfulQA MC240.29MC2 (%) (0-shot)13.5
Open Portuguese LLM - BLUEX21.28Accuracy (%)11.8
Open Portuguese LLM - OAB Exams23.83Accuracy (%)11.3

Interactive version: theaggregate.ai/model?slug=h2o-danube-1-8b-sft · How It Works · Data refreshed daily, snapshot 2026-09-23.