Views
No views yet
id: Unique identifier (book_name + section_name)book_name: Source book namesection_name: Section identifierfile_path: Original file pathmain_text: List of main text elements with labelstext: Referenced text contentnum_elements: Number of main text elementsnum_text_refs: Number of text references1from datasets import load_dataset
2
3# Load the dataset
4dataset = load_dataset("youssefkhalil320/epub-documents-dataset-v3")
5
6# Access a specific book (if split by book)
7book_data = dataset["book_name"]
8
9# Or load as single dataset
10# dataset = load_dataset("youssefkhalil320/epub-documents-dataset-v3", split="train")