Views
No views yet
pip install -U mlx-audio-plus| Mode | Parameters | Description |
|---|---|---|
| Cross-lingual | ref_audio | Zero-shot TTS (default) |
| Zero-shot | ref_audio + ref_text | Better quality with transcription |
| Instruct | ref_audio + instruct_text | Style control (e.g., "speak slowly") |
| Voice Conversion | source_audio + ref_audio | Convert audio to target voice |
1# Cross-lingual (default)
2mlx_audio.tts --model mlx-community/CosyVoice2-0.5B-fp16 --text "Hello!" --ref_audio ref.wav
3
4# Zero-shot (with transcription)
5mlx_audio.tts --model mlx-community/CosyVoice2-0.5B-fp16 --text "Hello!" --ref_audio ref.wav --ref_text "Transcription of ref audio."
6
7# Instruct (style control)
8mlx_audio.tts --model mlx-community/CosyVoice2-0.5B-fp16 --text "Hello!" --ref_audio ref.wav --instruct_text "Speak slowly and calmly"
9
10# Voice Conversion
11mlx_audio.tts --model mlx-community/CosyVoice2-0.5B-fp16 --source_audio source.wav --ref_audio ref.wav1from mlx_audio.tts.generate import generate_audio
2
3generate_audio(
4 text="Hello, this is CosyVoice2 on MLX!",
5 model="mlx-community/CosyVoice2-0.5B-fp16",
6 ref_audio="reference.wav",
7 file_prefix="output",
8)