CarbonVillain-en-10.7B-v4: benchmark results

Provider: Other. Released 2024-03-01. Access: Open.

Unified ELO 1434 ± 1, rank #1017 of 1392 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC61.01Accuracy (%)85.5
Open Korean LLM Leaderboard41.06Average Score (%)78
Open Medical LLM - MMLU Clinical Knowledge73.58Accuracy (%)69.6
Open Medical LLM - MMLU College Medicine65.32Accuracy (%)69.3
Open Medical LLM - MMLU Professional Medicine72.79Accuracy (%)66.8
Open Chinese LLM - ARC Challenge54.27Accuracy (%)64.7
Open LLM Leaderboard - GPQA7.49Score63.2
Open LLM Leaderboard - BBH31.81Score58.6
Open Chinese LLM Leaderboard56.78Average Score (%)54.6
Open Medical LLM - MMLU College Biology74.31Accuracy (%)52.8
Open LLM Leaderboard - IFEval45.79Score51.3
Open Medical LLM - MedQA (USMLE)54.83Accuracy (%)50.6

Interactive version: theaggregate.ai/model?slug=carbonvillain-en-10-7b-v4 · How It Works · Data refreshed daily, snapshot 2026-09-05.