LLM Trustworthy - Fairness: leaderboard

Metric: Trust Score (%). Source: huggingface.co. 26 models tracked.

Top models

#ModelScore
1Llama 2 7B Chat100
2falcon-7B Instruct100
3tulu-2-13B97.9
4Claude 296.81
5zephyr-7B-beta95.07
6gemma-7B (IT)93.88
7gemma-2B (IT)93.02
8vicuna-7B-v1.385.53
9tulu-2-7B83.21
10Llama 3 8B Instruct80.05
11Gemini 1.0 Pro80.05
12GPT-3.5 Turbo (0301)77.57
13GPT-4o Mini (2024-07-18)69.74
14Mistral-7B-OpenOrca66.76
15GPT-4 (0314)63.67

Interactive version: theaggregate.ai/benchmark?slug=llm-trustworthy-fairness · How It Works · Data refreshed daily, snapshot 2026-09-05.