Final Data - LLaMA Fine-Tuning Dataset
This dataset is prepared for fine-tuning the meta-llama/Llama-2-7b-hf model using the TRL SFTTrainer.
train.json: Training examples in JSON format
validation.json: Validation examples
test.json: Optional test examples
Each file contains a list of items with this format:
{
"text": "Your training sample here..."
}
from datasets import load_dataset
dataset = load_dataset("csenaeem/final_data")
##… See the full description on the dataset page:
https://huggingface.co/datasets/csenaeem/final_data.