deep-solar-v2.0.7: benchmark results

Provider: Other. Access: Open.

Unified ELO 1376 ± 18, rank #2081 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande66.14Accuracy (%)87.5
Open Korean LLM - KorNAT-CKA26.05Normalized accuracy (%)61.9
Open Korean LLM - Ko-GSM8K (flexible extract)24.18Exact match, flexible extract (%)57.5
Open Korean LLM - KorNAT-Harmless62.96Normalized accuracy (%)52.4
Open Korean LLM - Ko-IFEval26.75Strict accuracy, prompt/instruction mean (%)40.2
Open Korean LLM - KorNAT-Helpful44.67Normalized accuracy (%)31.9
Open Korean LLM Leaderboard31.27Average Score (%)26.7
Open Ko-LLM Leaderboard31.27Average (%)26.5
Open Korean LLM - Ko-GPQA-Diamond20.71Normalized accuracy (%)18.8
Open Korean LLM - Ko-EQ-Bench-24.79EQ-Bench score0.9

Interactive version: theaggregate.ai/model?slug=deep-solar-v2-0-7 · How It Works · Data refreshed daily, snapshot 2026-09-19.