π IndicDLP :
A Foundational Dataset for Multi-Lingual and Multi-Domain Document Layout Parsing
IndicDLP is a large-scale foundational dataset designed to foster research in document layout parsing across multiple languages and domains. It contains richly annotated document images in 11 Indic languages plus English, across diverse document types.
ICDAR 2025 (Oral) β π Best Student Paper Runner-Up Award