3,000 examples of direct prompt injection across eight families. A curated, paired benign/attack dataset for evaluating and training prompt-injection detectors and LLM guardrails. Broad coverage of direct prompt injection: instruction override, system-prompt extraction, jailbreak personas, delimiter/format injection, obfuscation/encoding, data exfiltration, refusal suppression, and payload splitting.
Curated by Enes Deniz (ORCID 0009-0006-9491-3565)… See the full description on the dataset page:
https://huggingface.co/datasets/3nesdeniz/english-prompt-injection-3k.