Views
No views yet
1
2
3import torch
4import torch.nn.functional as F
5import soundfile as sf
6
7from transformers import (
8 Wav2Vec2FeatureExtractor,
9 HubertModel,
10)
11
12
13model_path=""
14wav_path=""
15
16feature_extractor = Wav2Vec2FeatureExtractor.from_pretrained(model_path)
17model = HubertModel.from_pretrained(model_path)
18
19# for pretrain: Wav2Vec2ForPreTraining
20# model = Wav2Vec2ForPreTraining.from_pretrained(model_path)
21
22model = model.to(device)
23model = model.half()
24model.eval()
25
26wav, sr = sf.read(wav_path)
27input_values = feature_extractor(wav, return_tensors="pt").input_values
28input_values = input_values.half()
29input_values = input_values.to(device)
30
31with torch.no_grad():
32 outputs = model(input_values)
33 last_hidden_state = outputs.last_hidden_state
34
35