Views
No views yet
tuk-script_latin).1import librosa
2import torch
3from transformers import Wav2Vec2ForCTC, AutoProcessor
4
5processor = AutoProcessor.from_pretrained("derkar00/mms-tuk-latin-asr")
6model = Wav2Vec2ForCTC.from_pretrained("derkar00/mms-tuk-latin-asr")
7
8processor.tokenizer.set_target_lang("tuk-script_latin")
9model.load_adapter("tuk-script_latin")
10
11# Load audio (must be 16kHz mono)
12audio, rate = librosa.load("your_audio.wav", sr=16000, mono=True)
13
14inputs = processor(audio, sampling_rate=16000, return_tensors="pt")
15with torch.no_grad():
16 logits = model(**inputs).logits
17
18predicted_ids = torch.argmax(logits, dim=-1)
19print(processor.decode(predicted_ids[0]))tuk)