tempmotacilla-cinerea-0308 — benchmark results
Cran-May's community Model Stock merge of Qwen2.5-14B derivatives, published under a temporary codename (March 2025). Provider: Other. Released 2025-03-08. Access: Open.
Unified ELO 1580 ± 16, rank #530 of 1776 rated models, from 179 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MATH Level 5 | 55.51 | Score | 99.2 |
| Open LLM Leaderboard - IFEval | 80.85 | Score | 98.3 |
| Open Arabic LLM - Aratrust Average | 89.98 | Accuracy (%) | 97.8 |
| Open Arabic LLM - Arabic MMLU Philosophy (High School) | 71.79 | Accuracy (%) | 97.5 |
| Open Arabic LLM - Aratrust MentalHealth | 96.05 | Accuracy (%) | 97.2 |
| Open Arabic LLM - Aratrust Offensive | 95.65 | Accuracy (%) | 97.2 |
| Open Arabic LLM - Arabic MMLU HT Security Studies | 73.06 | Accuracy (%) | 96.9 |
| Open Arabic LLM - Aratrust Ethics | 81.67 | Accuracy (%) | 95.7 |
| Open Arabic LLM - Arabic MMLU Arabic Language (Middle School) | 81.48 | Accuracy (%) | 93.2 |
| Open LLM Leaderboard - BBH | 50.6 | Score | 93.1 |
| Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Xglue Mlqa Task | 92.67 | Accuracy (%) | 92 |
| Open LLM Leaderboard - MMLU-Pro | 47.22 | Score | 91.1 |
Interactive version: theaggregate.ai/model?slug=tempmotacilla-cinerea-0308 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.