SAFE Audio Challenge Task 2 — leaderboard

SAFE Audio Challenge Task 2 evaluates generated audio detection systems with additional augmentation-source robustness metrics.

Metric: Balanced Accuracy (%). Source: huggingface.co. 11 models tracked.

Top models

#ModelScore
1baseline-285.97
2baseline-184
3ISPL82.23
4ISSF81.9
5Anon_Peking80.96
6JAIST-HIS73.39
7viper-purdue71.39
8csun2256.18
9DMF54.23
10safe-test51.4

Interactive version: theaggregate.ai/benchmark?slug=safe-audio-challenge-task-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.