trurl-2-7B: benchmark results

Provider: VoiceLab. Released 2023-08-16. Access: Open.

Unified ELO 1342 ± 1, rank #1282 of 1392 rated models, from 76 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Econometrics33.33Accuracy (%)80.1
MMLU-by-task - Anatomy50.37Accuracy (%)79.5
MMLU-by-task - High School Physics34.44Accuracy (%)78.6
MMLU-by-task - Formal Logic36.51Accuracy (%)76.5
MMLU-by-task - Security Studies62.45Accuracy (%)74.8
MMLU-by-task - High School Macroeconomics50.51Accuracy (%)70
MMLU-by-task - Medical Genetics57Accuracy (%)68.3
MMLU-by-task - High School Chemistry39.9Accuracy (%)67.8
MMLU-by-task - High School Government And Politics76.68Accuracy (%)67.2
MMLU-by-task - College Chemistry38Accuracy (%)66.3
MMLU-by-task - Business Ethics53Accuracy (%)66
MMLU-by-task - Jurisprudence64.81Accuracy (%)66

Interactive version: theaggregate.ai/model?slug=trurl-2-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.