Views
No views yet
batch_size=8,
grad_accum_steps=96,
batch_group_size=48,
eval_batch_size=8,
num_loader_workers=8,
eval_split_max_size=256,
optimizer="AdamW",
optimizer_wd_only_on_weights=True,
optimizer_params={"betas": [0.9, 0.96], "eps": 1e-8, "weight_decay": 1e-2},
lr=5e-06,
lr_scheduler="MultiStepLR",
lr_scheduler_params={"milestones": [50000 * 18, 150000 * 18, 300000 * 18], "gamma": 0.5, "last_epoch": -1},1 tts --model_name /path/to/xtts/ \
2 --text "Che boludo, vamos a tomar unos mates." \
3 --speaker_wav /path/to/target/speaker.wav \
4 --language_idx es \
5 --use_cuda true1from TTS.tts.configs.xtts_config import XttsConfig
2from TTS.tts.models.xtts import Xtts
3
4config = XttsConfig()
5config.load_json("/path/to/xtts/config.json")
6model = Xtts.init_from_config(config)
7model.load_checkpoint(config, checkpoint_dir="/path/to/xtts/", eval=True)
8model.cuda()
9
10outputs = model.synthesize(
11 "Che boludo, vamos a tomar unos mates.",
12 config,
13 speaker_wav="/data/TTS-public/_refclips/3.wav",
14 gpt_cond_len=3,
15 language="es",
16)