Rombos-LLM-V2.5-Qwen-32B: benchmark results

A Qwen-family base/instruct TIES merge released by rombodawg using the creator's continuous finetuning recipe. It remains distinct from the upstream Qwen releases. Provider: rombodawg. Access: Open.

Unified ELO 1629 ± 27, rank #353 of 1636 rated models, from 65 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MMLU-Pro59.16Score99.8
Open LLM Leaderboard - BBH70.46Score99.2
Open LLM Leaderboard - GPQA39.68Score98.8
Open LLM Leaderboard - MuSR50.34Score98.7
Open Portuguese LLM - ASSIN2 RTE94.69Macro F1 (%)98
Open Portuguese LLM - BLUEX78.58Accuracy (%)97.8
Open Portuguese LLM - ENEM84.81Accuracy (%)97.8
Open Japanese LLM - MR94.4Score (%)96.8
Open LLM Leaderboard - MATH Level 549.55Score96.5
Open Japanese LLM - Jnli Exact Match89.77Score (%)96.3
Open Portuguese LLM - OAB Exams63.05Accuracy (%)95.6
Open Japanese LLM - Jsick Exact Match85.79Score (%)95.4

Interactive version: theaggregate.ai/model?slug=rombos-llm-v2-5-qwen-32b · How It Works · Data refreshed daily, snapshot 2026-10-11.