Rombos-LLM-V2.5-Qwen-72B — benchmark results

rombodawg's continuous fine-tune of Qwen 2.5 72B (instruct TIES-merged with base). Provider: Other. Released 2024-09-30. Access: Open.

Unified ELO 1637 ± 10, rank #395 of 1776 rated models, from 129 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MMLU-Pro54.83Score99.8
Open LLM Leaderboard - BBH61.27Score99.6
Open Arabic LLM - Alghafa Multiple Choice Sentiment Task43.78Accuracy (%)99.4
Open Arabic LLM - Arabic MMLU Civics (High School)58.62Accuracy (%)99.4
Open Arabic LLM - Arabic MMLU Computer Science (High School)82.76Accuracy (%)99.4
Open Arabic LLM - Arabic MMLU HT Elementary Mathematics71.69Accuracy (%)99.4
Open Arabic LLM - Arabic MMLU LAW (Professional)80.89Accuracy (%)99.4
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Xglue Mlqa Task94.67Accuracy (%)99.1
Open Arabic LLM - Arabic MMLU Economics (High School)76.94Accuracy (%)99.1
Open LLM Leaderboard - GPQA19.8Score99
Open LLM Leaderboard - MATH Level 554.23Score98.9
Open Arabic LLM - Alghafa Meta AR Dialects84.71Accuracy (%)98.8

Interactive version: theaggregate.ai/model?slug=rombos-llm-v2-5-qwen-72b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.