h2o-danube2-1.8B-base: benchmark results

Provider: H2O.ai. Access: Open.

Unified ELO 1335 ± 21, rank #2566 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K29.8Accuracy (%) (5-shot)47
Open Portuguese LLM - BLUEX28.37Accuracy (%)24.2
Open LLM Leaderboard v1 - HellaSwag72.95Normalized accuracy (%) (10-shot)23.4
Open Portuguese LLM - ENEM27.15Accuracy (%)22.3
Open LLM Leaderboard v1 - WinoGrande68.03Accuracy (%) (5-shot)22.2
Open Portuguese LLM - ASSIN2 RTE62.92Macro F1 (%)22
Open LLM Leaderboard v1 - MMLU40.2Accuracy (%) (5-shot)21.2
Open Portuguese LLM - OAB Exams26.65Accuracy (%)20
Open LLM Leaderboard v1 - ARC Challenge43.34Normalized accuracy (%) (25-shot)19.2
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open LLM Leaderboard v1 - TruthfulQA MC238.01MC2 (%) (0-shot)7.1

Interactive version: theaggregate.ai/model?slug=h2o-danube2-1-8b-base · How It Works · Data refreshed daily, snapshot 2026-09-23.