Falcon3-7B-Base — benchmark results

Provider: TII. Released 2024-11-21. Access: Open.

Unified ELO 1375 ± 11, rank #1325 of 1776 rated models, from 204 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR18.14Score90.2
Open LLM Leaderboard - GPQA12.86Score86.7
EuroEval Spanish NLU - MLQA ES65.37Reading comprehension Score (%)84.2
EuroEval Portuguese NLU - MultiWikiQA PT73.64Reading comprehension Score (%)76.7
EuroEval Portuguese NLU - SST-2 PT81.44Sentiment classification Score (%)74.2
Open LLM Leaderboard - MMLU-Pro32.34Score70.9
Open LLM Leaderboard - MATH Level 519.41Score70
EuroEval Spanish NLU45.92NLU Average Score (%)61.2
EuroEval Portuguese48.27Average Score (%)57.6
EuroEval Spanish NLU - Sentiment Headlines ES41.57Sentiment classification Score (%)57.5
Open LLM Leaderboard - BBH31.56Score57.5
EuroEval Portuguese NLU51.46NLU Average Score (%)57.3

Interactive version: theaggregate.ai/model?slug=falcon3-7b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.