Peagle-9B: benchmark results

Provider: Other. Released 2024-04-01. Access: Open.

Unified ELO 1480 ± 14, rank #1281 of 2656 rated models, from 34 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Harmless73.75Normalized accuracy (%)96.7
Open Korean LLM - KorNAT-Helpful52.48Normalized accuracy (%)93.2
Open Chinese LLM - TruthfulQA MC59.78Accuracy (%)82.2
Open Korean LLM Leaderboard41.22Average Score (%)81.7
Open Ko-LLM Leaderboard41.22Average (%)81.6
Open Korean LLM - KorNAT-CKA29.34Normalized accuracy (%)79.3
Open Korean LLM - Ko-GSM8K (flexible extract)41.47Exact match, flexible extract (%)76.1
Open Korean LLM - Ko-EQ-Bench25.4EQ-Bench score71.3
Open Korean LLM - Ko-GPQA-Diamond24.75Normalized accuracy (%)69.5
Open Korean LLM - Ko-Winogrande62.27Accuracy (%)67.7
Open Korean LLM - Ko-IFEval33.57Strict accuracy, prompt/instruction mean (%)67.6
Open Medical LLM - MMLU College Medicine62.43Accuracy (%)51.7

Interactive version: theaggregate.ai/model?slug=peagle-9b · How It Works · Data refreshed daily, snapshot 2026-09-19.