falcon-7B — benchmark results

Provider: TII. Released 2023-05-25. Access: Open.

Unified ELO 1196 ± 16, rank #1696 of 1776 rated models, from 86 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Classic - WikiFact30.87Exact Match (%)68.2
OpenEval - XSum23.11ROUGE-L58.3
HELM Classic - MATH10.84Equivalent (%)55.9
HellaSwag78.1Accuracy (%)55.9
HELM Classic - TruthfulQA23.39Exact Match (%)53.8
Epoch AI - Lambada74.9Score52
HELM Classic - BoolQ75.3Exact Match (%)51.5
HELM Classic - NaturalQuestions Closed Book28.52F1 (%)51.5
HELM Classic - LSAT20.43Exact Match (%)48.5
OpenEval - CNN/DailyMail23.09ROUGE-L47.1
HELM Classic - RAFT60.23Exact Match (%)43.9
HELM Classic - MATH Chain-of-Thought4.21Equivalent (%)42.6

Interactive version: theaggregate.ai/model?slug=falcon-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.