Views
No views yet
| File | Model Type | Segment Length | Scale |
|---|---|---|---|
checkpoints/segment_len50.ckpt | SegmentTokenDiscriminator | 50 | - |
checkpoints/segment_len25.ckpt | SegmentTokenDiscriminator | 25 | - |
checkpoints/segment_len10.ckpt | SegmentTokenDiscriminator | 10 | - |
checkpoints/strided_seg50_scale10.ckpt | StridedSegmentTokenDiscriminator | 50 | 10 |
checkpoints/strided_seg50_scale25.ckpt | StridedSegmentTokenDiscriminator | 50 | 25 |
1vocab_size = 65536
2d_model = 256
3nhead = 8
4num_layers = 4
5dim_feedforward = 1024
6dropout = 0.1segment_len values of 10, 25, and 50.segment_len=50 with scales 10 and 25.pip install -U huggingface_hub1from huggingface_hub import hf_hub_download
2
3repo_id = "Chanson-0803/MSpoofTTS"
4
5ckpt_path = hf_hub_download(
6 repo_id=repo_id,
7 filename="checkpoints/segment_len50.ckpt",
8 repo_type="model",
9)
10
11print(ckpt_path)1import torch
2
3# Import this from the official MSpoofTTS codebase.
4# from your_mspoof_code import SegmentTokenDiscriminator
5
6state = torch.load(ckpt_path, map_location="cpu")
7model.load_state_dict(state["model_state_dict"])
8model.eval()1checkpoint_files = {
2 "segment_len50": "checkpoints/segment_len50.ckpt",
3 "segment_len25": "checkpoints/segment_len25.ckpt",
4 "segment_len10": "checkpoints/segment_len10.ckpt",
5 "strided_seg50_scale10": "checkpoints/strided_seg50_scale10.ckpt",
6 "strided_seg50_scale25": "checkpoints/strided_seg50_scale25.ckpt",
7}1@article{zhao2026hierarchical,
2 title={Hierarchical Decoding for Discrete Speech Synthesis with Multi-Resolution Spoof Detection},
3 author={Zhao, Junchuan and Vu, Minh Duc and Wang, Ye},
4 journal={arXiv preprint arXiv:2603.05373},
5 year={2026}
6}