falcon-40B Instruct: benchmark results

Provider: TII. Released 2023-05-25. Access: Open.

Unified ELO 1347 ± 11, rank #2249 of 2656 rated models, from 75 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Mathematics33.33Accuracy (%)93.3
MMLU-by-task - TruthfulQA MC137.7Accuracy (%)91
MMLU-by-task - Anatomy54.07Accuracy (%)90
MMLU-by-task - HellaSwag64.62Accuracy (%)88.1
MMLU-by-task - TruthfulQA MC252.52Accuracy (%)87.6
MMLU-by-task - Virology49.4Accuracy (%)87.4
MMLU-by-task - Professional Medicine58.09Accuracy (%)86.9
MMLU-by-task - Medical Genetics64Accuracy (%)86.3
MMLU-by-task - Human Sexuality67.18Accuracy (%)86
MMLU-by-task - Public Relations66.36Accuracy (%)85.5
MMLU-by-task - College Mathematics37Accuracy (%)85.2
MMLU-by-task - Management75.73Accuracy (%)84.7

Interactive version: theaggregate.ai/model?slug=falcon-40b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-19.