SOLAR-10.7B-orca-alpaca-gpt4-math: benchmark results

Provider: Upstage. Access: Open.

Unified ELO 1479 ± 17, rank #1299 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande67.17Accuracy (%)90.6
Open Korean LLM Leaderboard40.27Average Score (%)76
Open Ko-LLM Leaderboard40.27Average (%)75.9
Open Korean LLM - KorNAT-CKA27.65Normalized accuracy (%)71
Open Korean LLM - Ko-GSM8K (flexible extract)36.16Exact match, flexible extract (%)69.6
Open Korean LLM - Ko-IFEval33.34Strict accuracy, prompt/instruction mean (%)66
Open Korean LLM - Ko-EQ-Bench18.79EQ-Bench score65
Open Korean LLM - KorNAT-Helpful48.02Normalized accuracy (%)63.8
Open Korean LLM - KorNAT-Harmless63.23Normalized accuracy (%)58.6
Open Korean LLM - Ko-GPQA-Diamond21.21Normalized accuracy (%)24

Interactive version: theaggregate.ai/model?slug=solar-10-7b-orca-alpaca-gpt4-math · How It Works · Data refreshed daily, snapshot 2026-09-19.