Nxcode-CQ-7B-orpo: benchmark results
Provider: Other. Released 2024-04-24. Access: Open.
Unified ELO 1437 ± 1, rank #1003 of 1392 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| BigCode Models Leaderboard | 87.2 | HumanEval Python Pass@1 (%) | 99.2 |
| CanAiCode | 100 | Junior-v2 Python Pass Rate (%) | 85.6 |
| BigCodeBench | 39.6 | Pass@1 (%) | 56 |
| Open LLM Leaderboard - IFEval | 40.07 | Score | 39.9 |
| Open LLM Leaderboard - MuSR | 7.05 | Score | 33.3 |
| Open LLM Leaderboard - BBH | 17.58 | Score | 26.6 |
| Open LLM Leaderboard - MMLU-Pro | 6.79 | Score | 16.7 |
| Open LLM Leaderboard - MATH Level 5 | 2.19 | Score | 15.1 |
| Open LLM Leaderboard - GPQA | 0.56 | Score | 7.5 |
| Open Korean LLM Leaderboard | 25.37 | Average Score (%) | 0 |
Interactive version: theaggregate.ai/model?slug=nxcode-cq-7b-orpo · How It Works · Data refreshed daily, snapshot 2026-09-05.