Views
No views yet
pip install librosa>=0.10.2 transformers==4.46.3 diffusers==0.29.0 conformer==0.3.2 numpy>=2.0.0 torchcodec s3tokenizer num2words1from huggingface_hub import snapshot_download
2from transformers import AutoModel
3path = snapshot_download(repo_id="soynade-research/Oolel-Voices")
4model = AutoModel.from_pretrained(path, trust_remote_code=True)1import torchaudio
2text = """Su ko nit ñi laajee: Ñan ngay defal say filme? day tontu naan: Europe mooy sama marché, waaye ñimay seetaan, Afrique lañu nekk. Fii ci réewum Europe laa wara ñëw ngir wut xaalis bi may defare samay filme, parce que fi la dooley koom-koom bi nekk. Waaye ñi ma jublu, maanaam ñi ma bëgg jàppale ci seen yewwute jaarale ko ci samay filme, Afrique lañu nekk. Du Sénégal kese, waaye ci Afrique yépp."""
3
4wav = model.generate(text,
5 audio_prompt_path="https://huggingface.co/spaces/soynade-research/Oolel-Voices-Demo/resolve/main/8_1_c.wav",
6 cfg_weight=0.5,
7 exaggeration=0.2,
8 temperature=0.3
9 )
10
11torchaudio.save("oolel_voices_speech.wav", wav, model.sr)