This dataset is a remastered version of this dataset prepared using Adaption's Adaptive Data platform.
This dataset is a multilingual Indian legal corpus containing prompt-completion pairs derived from publicly available legal sources in languages including English, Hindi, Tamil, Marathi, Bengali, Odia, and Telugu. The content covers diverse legal topics such as admissibility of evidence, procedural hearings, tax exemptions, and property rights… See the full description on the dataset page:
https://huggingface.co/datasets/morningstarxcdcode/adaption-legalbrain-indic-legal.