Views
No views yet
1!pip install chatterbox-tts
2!pip install -U ml_dtypes1!pip install chatterbox-tts==0.1.1
2!pip install -U ml_dtypes
3!pip install transformers==4.44.2 peft==0.11.11import torch
2from IPython.display import Audio, display
3from chatterbox.tts import ChatterboxTTS
4from huggingface_hub import hf_hub_download
5from safetensors.torch import load_file
6
7# Definisikan repo dan nama file checkpoint
8MODEL_REPO = "grandhigh/Chatterbox-TTS-Indonesian"
9CHECKPOINT_FILENAME = "t3_cfg.safetensors"
10
11# Inisialisasi model di perangkat CUDA
12model = ChatterboxTTS.from_pretrained(device="cuda")
13
14# Unduh checkpoint dari Hugging Face Hub
15checkpoint_path = hf_hub_download(repo_id=MODEL_REPO, filename=CHECKPOINT_FILENAME)
16t3_state = load_file(checkpoint_path, device="cpu")
17
18# Muat state_dict ke dalam model
19model.t3.load_state_dict(t3_state)
20
21# Kosongkan cache GPU
22torch.cuda.empty_cache()model.generate() untuk mengubah teks menjadi audio.1TEXT_TO_SYNTHESIZE = "Bahwa sesungguhnya kemerdekaan itu ialah hak segala bangsa dan oleh sebab itu, maka penjajahan di atas dunia harus dihapuskan, karena tidak sesuai dengan perikemanusiaan dan perikeadilan."
2
3# Hasilkan audio
4wav_audio = model.generate(TEXT_TO_SYNTHESIZE)
5
6# Tampilkan audio di notebook
7display(Audio(wav_audio.numpy(), rate=model.sr))input.wav) yang tersedia di lokasi yang ditentukan. Anda juga dapat menggunakan file dari URL.1# Ganti dengan path ke file audio prompt Anda
2audio_prompt_path = '/content/input.wav'
3
4# Hasilkan audio dengan prompt dan spesifikkan bahasa
5wav_audio_clone = model.generate(
6 TEXT_TO_SYNTHESIZE,
7 audio_prompt_path=audio_prompt_path
8)
9
10# Tampilkan audio di notebook
11display(Audio(wav_audio_clone.numpy(), rate=model.sr))@misc{chatterboxtts2025,
author = {{Resemble AI}},
title = {{Chatterbox-TTS}},
year = {2025},
howpublished = {\url{https://github.com/resemble-ai/chatterbox}},
note = {GitHub repository}
}@article{fleurs2022arxiv,
title = {FLEURS: Few-shot Learning Evaluation of Universal Representations of Speech},
author = {Conneau, Alexis and Ma, Min and Khanuja, Simran and Zhang, Yu and Axelrod, Vera and Dalmia, Siddharth and Riesa, Jason and Rivera, Clara and Bapna, Ankur},
journal={arXiv preprint arXiv:2205.12446},
url = {https://arxiv.org/abs/2205.12446},
year = {2022},
}