CarbonVillain-en-10.7B-v4 — benchmark results

Provider: Other. Released 2024-03-01. Access: Open.

Unified ELO 1392 ± 18, rank #1264 of 1776 rated models, from 25 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC61.01Accuracy (%)85.5
Open Korean LLM Leaderboard419.94Average Score (%)79.2
Open Medical LLM - MMLU Clinical Knowledge73.58Accuracy (%)69.6
Open Medical LLM - MMLU College Medicine65.32Accuracy (%)69.3
Open Medical LLM - MMLU Professional Medicine72.79Accuracy (%)66.8
Open Chinese LLM - ARC Challenge54.27Accuracy (%)64.7
Open LLM Leaderboard - GPQA7.49Score63.1
Open LLM Leaderboard - BBH31.81Score58.7
Open Chinese LLM Leaderboard56.78Average Score (%)54.6
Open Medical LLM - MMLU College Biology74.31Accuracy (%)52.8
Open LLM Leaderboard - IFEval45.79Score51.3
Open Medical LLM - MedQA (USMLE)54.83Accuracy (%)50.6

Interactive version: theaggregate.ai/model?slug=carbonvillain-en-10-7b-v4 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.