AceCoder-Qwen2.5-Coder-7B-Base-Rule: benchmark results

Provider: Other. Access: Open.

Unified ELO 1402 ± 61, rank #1892 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ASSIN2 RTE92.19Macro F1 (%)75.7
Open Portuguese LLM - BLUEX58.41Accuracy (%)73.2
Open LLM Leaderboard - MATH Level 520.17Score71.1
Open Portuguese LLM - OAB Exams47.74Accuracy (%)67.3
Open LLM Leaderboard - MMLU-Pro37.45Score62.3
Open LLM Leaderboard - IFEval44.08Score47.6
Open LLM Leaderboard - BBH49.02Score44.6
Open Portuguese LLM - FaQuAD NLI53.78Macro F1 (%)36
Open Portuguese LLM - ENEM41.29Accuracy (%)30.4
Open LLM Leaderboard - GPQA27.18Score26.7
Open LLM Leaderboard - MuSR34.49Score10.7

Interactive version: theaggregate.ai/model?slug=acecoder-qwen2-5-coder-7b-base-rule · How It Works · Data refreshed daily, snapshot 2026-09-19.