falcon-40B: benchmark results

Provider: TII. Released 2023-05-25. Access: Open.

Unified ELO 1393 ± 1, rank #1164 of 1392 rated models, from 52 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Classic - WikiFact38.03Exact Match (%)95.5
HELM Classic - NaturalQuestions Closed Book39.22F1 (%)92.4
HELM Classic - MATH20.98Equivalent (%)88.2
HELM Classic - IMDB95.9Exact Match (%)87.9
HELM Classic - MMLU50.89Exact Match (%)87.9
HELM Classic - NaturalQuestions Open Book67.53F1 (%)86.2
HELM Classic - bAbI57.62Exact Match (%)85.5
HellaSwag85.28Accuracy (%)85.5
HELM Classic - LegalSupport60.53Exact Match (%)85.3
HELM Classic - GSM8K25Exact Match (%)82.4
HELM Classic - MATH Chain-of-Thought13.01Equivalent (%)82.4
HELM Classic - Entity Data Imputation83.01Exact Match (%)81.8

Interactive version: theaggregate.ai/model?slug=falcon-40b · How It Works · Data refreshed daily, snapshot 2026-09-05.