Security vulnerability dataset from CrossVul with 9,313 before/after code pairs across 158 CWE categories and 21 programming languages.
Contains vulnerable code examples paired with their secure fixes, ideal for training AI models on security code remediation.
Dataset Statistics
Total Examples: 9,313
CWE Categories: 158
Languages: 21
Format: Raw vulnerability records (JSON Lines)
Top Languages… See the full description on the dataset page: https://huggingface.co/datasets/hitoshura25/crossvul.