wj-vanilla_benign
データセットの説明
JSONファイル: 各 split 用サブフォルダ内の元データ(train/)
Parquetファイル: split名をプレフィックスとした最適化データ(data/train_*.parquet)
train_data = load_dataset("neko-llm/wj-vanilla_benign"… See the full description on the dataset page:
https://huggingface.co/datasets/neko-llm/wj-vanilla_benign.