Falcon3-10B-Base — benchmark results
Provider: TII. Released 2024-12-03. Access: Open.
Unified ELO 1394 ± 12, rank #1255 of 1776 rated models, from 179 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - GPQA | 12.75 | Score | 86.3 |
| Open LLM Leaderboard - BBH | 41.38 | Score | 80.6 |
| Open LLM Leaderboard - MATH Level 5 | 24.92 | Score | 78 |
| Open LLM Leaderboard - MuSR | 14.17 | Score | 77.5 |
| Open Japanese LLM - Wiki PAS SET F1 | 8.11 | Score (%) | 77.2 |
| Open LLM Leaderboard - MMLU-Pro | 36 | Score | 77 |
| Open Japanese LLM - Wiki NER SET F1 | 7.96 | Score (%) | 67.4 |
| Open Japanese LLM - Wiki Dependency SET F1 | 36.68 | Score (%) | 65.6 |
| Open Arabic LLM - Arabic MMLU HT College Mathematics | 31 | Accuracy (%) | 51.9 |
| Open Arabic LLM - Aratrust Offensive | 79.71 | Accuracy (%) | 49.7 |
| Open Arabic LLM - Arabic MMLU LAW (Professional) | 62.42 | Accuracy (%) | 49.4 |
| Open Arabic LLM - Arabic MMLU HT Formal Logic | 37.3 | Accuracy (%) | 48.5 |
Interactive version: theaggregate.ai/model?slug=falcon3-10b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.