AceCoder-Qwen2.5-7B-Ins-Rule: benchmark results

Provider: Other. Access: Open.

Unified ELO 1538 ± 60, rank #900 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 549.92Score96.9
Open Portuguese LLM - FaQuAD NLI82.74Macro F1 (%)95.3
Open Portuguese LLM - ASSIN2 RTE94.04Macro F1 (%)94.2
Open LLM Leaderboard - IFEval74.24Score89.3
Open Portuguese LLM - ENEM74.95Accuracy (%)88
Open Portuguese LLM - BLUEX64.26Accuracy (%)84.7
Open Portuguese LLM - OAB Exams53.53Accuracy (%)83.8
Open LLM Leaderboard - MMLU-Pro43.22Score78.2
Open LLM Leaderboard - BBH54.04Score69.1
Open LLM Leaderboard - GPQA30.12Score57.4
Open LLM Leaderboard - MuSR39.8Score40.4

Interactive version: theaggregate.ai/model?slug=acecoder-qwen2-5-7b-ins-rule · How It Works · Data refreshed daily, snapshot 2026-09-19.