falcon-rw-1B-instruct-openorca: benchmark results

Provider: TII. Access: Open.

Unified ELO 1250 ± 20, rank #2810 of 2928 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K3.41Accuracy (%) (5-shot)21.5
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open Portuguese LLM - BLUEX23.23Accuracy (%)16.3
Open LLM Leaderboard v1 - MMLU28.77Accuracy (%) (5-shot)16.1
Open LLM Leaderboard v1 - HellaSwag60.93Normalized accuracy (%) (10-shot)14.9
Open Portuguese LLM - ENEM20.64Accuracy (%)14.8
Open Portuguese LLM - OAB Exams24.83Accuracy (%)14.7
Open LLM Leaderboard v1 - WinoGrande60.69Accuracy (%) (5-shot)13.8
Open LLM Leaderboard v1 - ARC Challenge34.56Normalized accuracy (%) (25-shot)12.6
Open Portuguese LLM - ASSIN2 RTE34.29Macro F1 (%)8.8
Open LLM Leaderboard v1 - TruthfulQA MC237.42MC2 (%) (0-shot)5.8

Interactive version: theaggregate.ai/model?slug=falcon-rw-1b-instruct-openorca · How It Works · Data refreshed daily, snapshot 2026-09-23.