falcon-40B Instruct — benchmark results

Provider: TII. Released 2023-05-25. Access: Open.

Unified ELO 1246 ± 14, rank #1625 of 1776 rated models, from 82 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Mathematics33.33Accuracy (%)93.3
MMLU-by-task - TruthfulQA MC137.7Accuracy (%)91
MMLU-by-task - Anatomy54.07Accuracy (%)90
MMLU-by-task - HellaSwag64.62Accuracy (%)88.1
MMLU-by-task - TruthfulQA MC252.52Accuracy (%)87.6
MMLU-by-task - Virology49.4Accuracy (%)87.4
MMLU-by-task - Professional Medicine58.09Accuracy (%)86.9
MMLU-by-task - Medical Genetics64Accuracy (%)86.3
MMLU-by-task - Human Sexuality67.18Accuracy (%)86
MMLU-by-task - Public Relations66.36Accuracy (%)85.5
MMLU-by-task - College Mathematics37Accuracy (%)85.2
MMLU-by-task - Management75.73Accuracy (%)84.7

Interactive version: theaggregate.ai/model?slug=falcon-40b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.