Rombos-LLM-V2.6-Qwen-14B — benchmark results
rombodawg's continuous-finetune of Qwen2.5 14B Instruct, an incremental V2.6 update in his Rombos-LLM series. Provider: Other. Released 2024-10-12. Access: Open.
Unified ELO 1520 ± 14, rank #723 of 1776 rated models, from 130 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 84.32 | Score | 99.7 |
| Open LLM Leaderboard - MATH Level 5 | 52.11 | Score | 97.8 |
| Open Korean LLM Leaderboard | 768.15 | Average Score (%) | 97.4 |
| Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Soqal Task | 94.67 | Accuracy (%) | 96.9 |
| Open Arabic LLM - Aratrust Unfairness | 94.55 | Accuracy (%) | 91 |
| Open Arabic LLM - Aratrust Privacy | 96.49 | Accuracy (%) | 90.4 |
| Open LLM Leaderboard - BBH | 49.28 | Score | 90.2 |
| Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Xglue Mlqa Task | 92 | Accuracy (%) | 88.9 |
| Open LLM Leaderboard - MMLU-Pro | 44.01 | Score | 87.4 |
| Open Arabic LLM - Arabic MMLU Geography (Middle School) | 72.79 | Accuracy (%) | 86.7 |
| Open Arabic LLM - Arabic MMLU HT Moral Scenarios | 51.62 | Accuracy (%) | 85.5 |
| Open Arabic LLM - Arabic MMLU HT Machine Learning | 49.11 | Accuracy (%) | 84.6 |
Interactive version: theaggregate.ai/model?slug=rombos-llm-v2-6-qwen-14b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.