Falcon3-1B-Instruct: benchmark results

Provider: TII. Released 2024-12-17. Access: Open.

Unified ELO 1268 ± 25, rank #2544 of 2656 rated models, from 106 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
BFCL V4 - Irrelevance Detection87.3Accuracy (%)79.3
MEDIC Benchmark69.39MEDIC Public Table Average73.7
Open LLM Leaderboard - IFEval55.57Score67.2
Open LLM Leaderboard - MuSR41.89Score59.5
Open LLM Leaderboard - MATH Level 56.34Score34.6
Open Portuguese LLM - FaQuAD NLI51.95Macro F1 (%)33.4
EuroEval Portuguese NLU - MultiWikiQA PT52.49Reading comprehension Score (%)29.7
Open Portuguese LLM - ASSIN2 RTE76.08Macro F1 (%)27.8
Open Portuguese LLM - BLUEX31.57Accuracy (%)27.6
Open Portuguese LLM - ENEM34.57Accuracy (%)27.3
Open Portuguese LLM - OAB Exams30.84Accuracy (%)27.1
EuroEval Portuguese NLU - ScaLA PT2.08Linguistic acceptability Score (%)25.2

Interactive version: theaggregate.ai/model?slug=falcon3-1b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-19.