falcon-40B — benchmark results

Provider: TII. Released 2023-05-25. Access: Open.

Unified ELO 1296 ± 15, rank #1541 of 1776 rated models, from 56 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenEval - BoolQ87.5Exact Match (%)97.6
HELM Classic - WikiFact38.03Exact Match (%)95.5
HELM Classic - NaturalQuestions Closed Book39.22F1 (%)92.4
OpenEval - IMDb95.45Exact Match (%)90.5
HELM Classic - MATH20.98Equivalent (%)88.2
HELM Classic - IMDB95.9Exact Match (%)87.9
HELM Classic - MMLU50.89Exact Match (%)87.9
HELM Classic - NaturalQuestions Open Book67.53F1 (%)86.2
HELM Classic - bAbI57.62Exact Match (%)85.5
HellaSwag85.28Accuracy (%)85.5
HELM Classic - LegalSupport60.53Exact Match (%)85.3
HELM Classic - GSM8K25Exact Match (%)82.4

Interactive version: theaggregate.ai/model?slug=falcon-40b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.