Ultiima-72B — benchmark results

Sakalti's community TIES merge of Qwen 2.5 72B fine-tunes. Provider: Other. Released 2025-01-09. Access: Open.

Unified ELO 1636 ± 10, rank #398 of 1776 rated models, from 129 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - GPQA21.92Score99.7
Open LLM Leaderboard - BBH61.1Score99.6
Open LLM Leaderboard - MMLU-Pro54.51Score99.6
Open Arabic LLM - Arabic MMLU Computer Science (High School)82.76Accuracy (%)99.4
Open Arabic LLM - Arabic MMLU HT Prehistory81.17Accuracy (%)99.4
Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Xglue Mlqa Task94.67Accuracy (%)99.1
Open Arabic LLM - Arabic MMLU General Knowledge73.61Accuracy (%)98.8
Open Arabic LLM - Arabic MMLU HT College Medicine73.99Accuracy (%)98.8
Open Arabic LLM - Aratrust PhysicalHealth94.52Accuracy (%)98.8
Open Arabic LLM - Arabic MMLU General Knowledge (Middle School)83.72Accuracy (%)98.5
Open Arabic LLM - Arabic MMLU HT Human Aging75.34Accuracy (%)98.5
Open Arabic LLM - Arabic MMLU Physics (High School)69.02Accuracy (%)98.5

Interactive version: theaggregate.ai/model?slug=ultiima-72b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.