falcon-7B: benchmark results

Provider: TII. Released 2023-05-25. Access: Open.

Unified ELO 1297 ± 1, rank #1349 of 1392 rated models, from 81 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Classic - WikiFact30.87Exact Match (%)68.2
HELM Classic - MATH10.84Equivalent (%)55.9
HellaSwag78.1Accuracy (%)55.9
HELM Classic - TruthfulQA23.39Exact Match (%)53.8
Epoch AI - Lambada74.9Score52
HELM Classic - BoolQ75.3Exact Match (%)51.5
HELM Classic - NaturalQuestions Closed Book28.52F1 (%)51.5
HELM Classic - LSAT20.43Exact Match (%)48.5
HELM Classic - RAFT60.23Exact Match (%)43.9
HELM Classic - MATH Chain-of-Thought4.21Equivalent (%)42.6
HELM Classic - GSM8K4Exact Match (%)41.2
PIQA80.3Accuracy (%)40.8

Interactive version: theaggregate.ai/model?slug=falcon-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.