MMLU-by-task - Econometrics: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 1257 models tracked.

Top models

#ModelScore
1Mistral-7B-v0.150
2Llama 2 70B Base44.74
3Llama 2 70B Chat44.74
4Llama 2 70B Chat (HF)41.23
5Llama 2 7B Chat37.72
6LLaMA-65B37.72
7LLaMA-30B35.96
8vicuna-33B-v1.335.09
9trurl-2-7B33.33
10CodeLlama-7B-Instruct-hf32.46
11vicuna-13B-v1.532.46
12Llama 2 13B Chat Base31.58
13starcoder30.7
14ChatGLM2 6B30.7
15vicuna-13B29.82

Interactive version: theaggregate.ai/benchmark?slug=mmlu-by-task-econometrics · How It Works · Data refreshed daily, snapshot 2026-09-05.