PandaBench: leaderboard
LLM safety benchmark for jailbreak attacks, defense mechanisms, judges, and safety-capability tradeoffs across model and defense configurations.
Source: huggingface.co.
Interactive version: theaggregate.ai/benchmark?slug=pandabench · How It Works · Data refreshed daily, snapshot 2026-09-05.