Views
No views yet
swechatelangana/swecha-gonthuka-asrte)1import librosa
2import torch
3from transformers import AutoProcessor, AutoModelForCTC
4
5processor = AutoProcessor.from_pretrained(
6 "Sujji77/swecha-gonthuka-finetuned"
7)
8
9model = AutoModelForCTC.from_pretrained(
10 "Sujji77/swecha-gonthuka-finetuned"
11)
12
13audio, sr = librosa.load("sample.wav", sr=16000)
14
15inputs = processor(
16 audio,
17 sampling_rate=16000,
18 return_tensors="pt"
19)
20
21with torch.no_grad():
22 logits = model(**inputs).logits
23
24pred_ids = torch.argmax(logits, dim=-1)
25
26transcription = processor.batch_decode(pred_ids)[0]
27
28print(transcription)| Item | Value |
|---|---|
| Base Model | Swecha Gonthuka ASR |
| Architecture | Wav2Vec2ForCTC |
| Framework | Transformers |
| Language | Telugu |
| Task | Automatic Speech Recognition |