BgGPT-7B-Instruct-v0.2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1444 ± 17, rank #1778 of 2928 rated models, from 129 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Alghafa Multiple Choice Sentiment Task40.81Accuracy (%)74.1
Open LLM Leaderboard v1 - TruthfulQA MC254.63MC2 (%) (0-shot)63.1
Open LLM Leaderboard v1 - GSM8K44.12Accuracy (%) (5-shot)58.3
Open LLM Leaderboard v1 - HellaSwag82.18Normalized accuracy (%) (10-shot)49.4
Open LLM Leaderboard v1 - WinoGrande76.48Accuracy (%) (5-shot)48.5
Open LLM Leaderboard v1 - ARC Challenge60.58Normalized accuracy (%) (25-shot)48.4
Open LLM Leaderboard v1 - MMLU60.5Accuracy (%) (5-shot)48.4
Open Arabic LLM - Arabic MMLU HT Econometrics30.7Accuracy (%)45.4
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Xglue Mlqa Task74Accuracy (%)44.8
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Soqal Task75.33Accuracy (%)43.5
Open Arabic LLM - Arabic MMLU HT Abstract Algebra27Accuracy (%)43.2
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task49.87Accuracy (%)42.6

Interactive version: theaggregate.ai/model?slug=bggpt-7b-instruct-v0-2 · How It Works · Data refreshed daily, snapshot 2026-09-23.