OLMo-7B: benchmark results

Provider: Allen AI. Access: Open.

Unified ELO 1174 ± 23, rank #1552 of 1605 rated models, from 93 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Lite - LegalBench - International Citizenship Questions54Exact Match (%)47.8
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open Portuguese LLM - OAB Exams25.24Accuracy (%)15.9
HELM NarrativeQA59.71F1 (%)13.3
HELM Lite - LegalBench - Corporate Lobbying19.59Exact Match (%)12.2
HELM Lite - WMT 2014 (ru-en)12.42BLEU-4 (%)12.2
HELM NaturalQuestions (Open)60.35F1 (%)12.2
Open Portuguese LLM - BLUEX21Accuracy (%)11.2
HELM NaturalQuestions (Closed)25.86F1 (%)11.1
Open Portuguese LLM - ENEM19.73Accuracy (%)11.1
Open Portuguese LLM - ASSIN2 RTE33.97Macro F1 (%)8.5
HELM MMLU - High School Statistics45.37EM7.1

Interactive version: theaggregate.ai/model?slug=olmo-7b · How It Works · Data refreshed daily, snapshot 2026-09-26.