trurl-2-7B — benchmark results

Provider: VoiceLab. Released 2023-08-16. Access: Open.

Unified ELO 1215 ± 14, rank #1672 of 1776 rated models, from 76 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Econometrics33.33Accuracy (%)80.1
MMLU-by-task - Anatomy50.37Accuracy (%)79.5
MMLU-by-task - High School Physics34.44Accuracy (%)78.6
MMLU-by-task - Formal Logic36.51Accuracy (%)76.5
MMLU-by-task - Security Studies62.45Accuracy (%)74.8
MMLU-by-task - High School Macroeconomics50.51Accuracy (%)70
MMLU-by-task - Medical Genetics57Accuracy (%)68.3
MMLU-by-task - High School Chemistry39.9Accuracy (%)67.8
MMLU-by-task - High School Government And Politics76.68Accuracy (%)67.2
MMLU-by-task - College Chemistry38Accuracy (%)66.3
MMLU-by-task - Business Ethics53Accuracy (%)66
MMLU-by-task - Jurisprudence64.81Accuracy (%)66

Interactive version: theaggregate.ai/model?slug=trurl-2-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.