Views
No views yet

1@misc{li2023styletts,
2 title={StyleTTS 2: Towards Human-Level Text-to-Speech through Style Diffusion and Adversarial Training with Large Speech Language Models},
3 author={Yinghao Aaron Li and Cong Han and Vinay S. Raghavan and Gavin Mischler and Nima Mesgarani},
4 year={2023},
5 eprint={2306.07691},
6 archivePrefix={arXiv},
7 primaryClass={eess.AS}
8}
9
10@misc{zen2019libritts,
11 title={LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech},
12 author={Heiga Zen and Viet Dang and Rob Clark and Yu Zhang and Ron J. Weiss and Ye Jia and Zhifeng Chen and Yonghui Wu},
13 year={2019},
14 eprint={1904.02882},
15 archivePrefix={arXiv},
16 primaryClass={cs.SD}
17}
18
19Christophe Veaux, Junichi Yamagishi, Kirsten MacDonald,
20"CSTR VCTK Corpus: English Multi-speaker Corpus for CSTR Voice Cloning Toolkit",
21The Centre for Speech Technology Research (CSTR),
22University of EdinburghMIT