EconLogicQA — leaderboard

Metric: Accuracy. Source: huggingface.co. 18 models tracked.

Top models

#ModelScore
1GPT-4 Turbo0.57
2GPT-40.55
3GPT-3.5 Turbo0.38
4Llama 3 8B Instruct0.35
5Mistral 7B Instruct (v0.2)0.32
6Mistral-7B-v0.10.26
7Mistral-7B-v0.20.26
8Llama 3 8B0.24
9zephyr-7B-alpha0.23
10Yi 6B (Chat)0.21
11zephyr-7B-beta0.18
12Mistral 7B Instruct (v0.1)0.15
13Llama 2 13B Chat0.15
14Llama 2 7B Chat0.09
15gemma-2B (IT)0.08

Interactive version: theaggregate.ai/benchmark?slug=econlogicqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.