TOFU LLaMA 1%: leaderboard
TOFU evaluates machine unlearning for large language models on fictitious author QA data; this leaderboard variant reports LLaMA submissions at the 1% forget-set setting.
Metric: Forget Quality x Model Utility. Source: huggingface.co. 6 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | LLaMA 2-7B - Retain Model (WD=0.01) | 0.62 |
| 2 | LLaMA 2-7B - Pref. Opt. (WD=0.01) | 0.01 |
| 3 | LLaMA 2-7B - Grad. Ascent (WD=0.01) | 0.01 |
| 4 | LLaMA 2-7B - KL Min. (WD=0.01) | 0.01 |
| 5 | LLaMA 2-7B - Grad. Diff. (WD=0.01) | 0 |
| 6 | LLaMA 2-7B - Finetune Model (WD=0.01) | 0 |
Interactive version: theaggregate.ai/benchmark?slug=tofu-llama-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.