한국어 가드레일 데이터셋 (11-Class)
데이터셋 설명
한국어 혐오발언과 프롬프트 인젝션을 탐지하기 위한 11-class 텍스트 분류 데이터셋입니다.
LLM 가드레일 모델 학습에 사용되며, 안전한 AI 시스템 구축을 목표로 합니다.
RACE
인종, 민족에 대한 차별 및 혐오… See the full description on the dataset page:
https://huggingface.co/datasets/prismdata/guardrail-ko-11class-dataset.