This dataset is derived from jwidmer/missiven-inference and has been enriched with inference results.
This dataset contains 2,480 samples across 1 split(s).
No project metadata available.
Duplicate line statistics are calculated from the dataset key columns filename, region_id, and line_id, plus project_name when project metadata is… See the full description on the dataset page:
https://huggingface.co/datasets/jwidmer/missiven-inference.