Views
No views yet
1["Surjapuri",
2"Marathi",
3"Assamese",
4"Haryanvi",
5"Halbi",
6"Malayalam",
7"Maithili",
8"Wancho",
9"Chhattisgarhi",
10"Punjabi",
11"Magahi",
12"Nepali",
13"Garhwali",
14"Garo",
15"Khortha",
16"Sumi",
17"Bajjika",
18"Marwari",
19"Telugu",
20"Nagamese",
21"Tulu",
22"Odia",
23"Urdu",
24"Kumaoni",
25"Kannada",
26"Tamil",
27"Sambalpuri",
28"Bengali",
29"Rajasthani",
30"English",
31"Malvani",
32"Chakma",
33"Surgujia",
34"Kokborok",
35"Khariboli",
36"Hindi",
37"Kurukh",
38"Angika",
39"Sadri",
40"Bhojpuri",
41"Konkani",
42"Gujarati"]1from transformers import pipeline
2
3pipe = pipeline(
4 "audio-classification",
5 model="ARTPARK-IISc/Vaani-LID_v0",
6 trust_remote_code=True,
7 # device=-1 # uncomment this line to run on cpu
8)
9
10out = pipe("path/to/16kHz/mono-channel/wav/file")
11print(out)@misc{pulikodan2026vaanicapturinglanguagelandscape,
title={VAANI: Capturing the language landscape for an inclusive digital India},
author={Sujith Pulikodan and Abhayjeet Singh and Agneedh Basu and Nihar Desai and Pavan Kumar J and Pranav D Bhat and Raghu Dharmaraju and Ritika Gupta and Sathvik Udupa and Saurabh Kumar and Sumit Sharma and Vaibhav Vishwakarma and Visruth Sanka and Dinesh Tewari and Harsh Dhand and Amrita Kamat and Sukhwinder Singh and Shikhar Vashishth and Partha Talukdar and Raj Acharya and Prasanta Kumar Ghosh},
year={2026},
eprint={2603.28714},
archivePrefix={arXiv},
primaryClass={eess.AS},
url={https://arxiv.org/abs/2603.28714},
}