Falcon3-10B-Base — benchmark results

Provider: TII. Released 2024-12-03. Access: Open.

Unified ELO 1394 ± 12, rank #1255 of 1776 rated models, from 179 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA12.75Score86.3
Open LLM Leaderboard - BBH41.38Score80.6
Open LLM Leaderboard - MATH Level 524.92Score78
Open LLM Leaderboard - MuSR14.17Score77.5
Open Japanese LLM - Wiki PAS SET F18.11Score (%)77.2
Open LLM Leaderboard - MMLU-Pro36Score77
Open Japanese LLM - Wiki NER SET F17.96Score (%)67.4
Open Japanese LLM - Wiki Dependency SET F136.68Score (%)65.6
Open Arabic LLM - Arabic MMLU HT College Mathematics31Accuracy (%)51.9
Open Arabic LLM - Aratrust Offensive79.71Accuracy (%)49.7
Open Arabic LLM - Arabic MMLU LAW (Professional)62.42Accuracy (%)49.4
Open Arabic LLM - Arabic MMLU HT Formal Logic37.3Accuracy (%)48.5

Interactive version: theaggregate.ai/model?slug=falcon3-10b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.