This dataset contains AI safety and red-teaming examples intended for evaluating, training, and improving model safety behavior.
This dataset is intended for AI safety research, red-team evaluation, safety classifier development, LLM refusal and compliance testing, and model behavior analysis.
The dataset is provided in JSONL format… See the full description on the dataset page:
https://huggingface.co/datasets/votal-ai/ai-redteaming-safety-model.