AdvBench-Audio is an audio-version benchmark used in our study to evaluate the safety, jailbreak, and adversarial robustness of audio-language models (ALMs). It contains audio renderings of adversarial prompts paired with their corresponding targets for safety evaluation.
This dataset is used in our paper: ALMGuard: Safety Shortcuts and Where to Find Them as Guardrails for Audio-Language Models.