Views
No views yet
asr_only ~87k + ast 200k cap, conversational YouTube audio).1from peft import PeftModel
2from vibevoice.modular.modeling_vibevoice_asr import VibeVoiceASRForConditionalGeneration
3
4model = VibeVoiceASRForConditionalGeneration.from_pretrained("microsoft/VibeVoice-ASR", dtype="bfloat16")
5model = PeftModel.from_pretrained(model, "LocalAI-io/vibevoice-asr-it-yodas-only-lora")