Views
No views yet
swechatelangana/swecha-gonthuka-asrte)1import librosa
2import torch
3from transformers import AutoProcessor, AutoModelForCTC
4
5processor = AutoProcessor.from_pretrained(
6 "nandinipapisetti/swecha-gonthuka-asr"
7)
8model = AutoModelForCTC.from_pretrained(
9 "nandinipapisetti/swecha-gonthuka-asr"
10)
11
12audio, sr = librosa.load("sample.wav", sr=16000)
13inputs = processor(
14 audio,
15 sampling_rate=16000,
16 return_tensors="pt"
17)
18
19with torch.no_grad():
20 logits = model(**inputs).logits
21
22pred_ids = torch.argmax(logits, dim=-1)
23transcription = processor.batch_decode(pred_ids)[0]
24print(transcription)| Item | Value |
|---|---|
| Base Model | Swecha Gonthuka ASR |
| Architecture | Wav2Vec2ForCTC |
| Framework | Transformers |
| Language | Telugu |
| Task | Automatic Speech Recognition |