AceGPT-v2-8B-Chat: benchmark results

Provider: Other. Released 2024-06-20. Access: Open.

Unified ELO 1513 ± 1, rank #691 of 1553 rated models, from 141 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Aratrust MentalHealth96.05Accuracy (%)97.2
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task93.33Accuracy (%)86.7
Open Arabic LLM - Arabic MMLU History (High School)49.21Accuracy (%)84
Open Arabic LLM - Arabic MMLU Economics (Middle School)79.31Accuracy (%)79.6
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task54.11Accuracy (%)75.3
Open Arabic LLM - Arabic MMLU Islamic Studies (Middle School)69.33Accuracy (%)74.1
Open Arabic LLM - Arabic MMLU Arabic Language (Primary School)69.44Accuracy (%)73.5
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment NO Neutral Task78.69Accuracy (%)72.8
Open Arabic LLM - Arabic MMLU Civics (Middle School)53.39Accuracy (%)72.8
Open Arabic LLM - Arabic MMLU Economics (University)58.39Accuracy (%)72.8
Open Arabic LLM - Arabic MMLU Social Science (Primary School)76.17Accuracy (%)72.2
Open Arabic LLM - Arabic MMLU History (Middle School)65.52Accuracy (%)71.3

Interactive version: theaggregate.ai/model?slug=acegpt-v2-8b-chat · How It Works · Data refreshed daily, snapshot 2026-09-08.