h2o-danube2-1.8B-sft: benchmark results

Provider: H2O.ai. Access: Open.

Unified ELO 1318 ± 22, rank #2629 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K25.63Accuracy (%) (5-shot)44.1
Open Portuguese LLM - FaQuAD NLI54.55Macro F1 (%)36.8
Open Portuguese LLM - ASSIN2 RTE70.62Macro F1 (%)25.2
Open Portuguese LLM - OAB Exams28.34Accuracy (%)23.7
Open LLM Leaderboard v1 - HellaSwag72.75Normalized accuracy (%) (10-shot)23.2
Open LLM Leaderboard v1 - WinoGrande68.51Accuracy (%) (5-shot)22.7
Open Portuguese LLM - ENEM25.26Accuracy (%)21.2
Open Portuguese LLM - BLUEX24.9Accuracy (%)19.6
Open LLM Leaderboard v1 - ARC Challenge42.66Normalized accuracy (%) (25-shot)18.7
Open LLM Leaderboard v1 - MMLU35.9Accuracy (%) (5-shot)18.6
Open LLM Leaderboard v1 - TruthfulQA MC238.7MC2 (%) (0-shot)8.7

Interactive version: theaggregate.ai/model?slug=h2o-danube2-1-8b-sft · How It Works · Data refreshed daily, snapshot 2026-09-23.