This dataset publishes K. Takahashi's TeX research corpus in four complementary views:
canonical DOI records, uncatalogued archive records, section-aware retrieval chunks, and
an inventory of the original source ZIPs. The unmodified ZIP files are available under
raw/, while all viewer-facing data is provided directly as Parquet.