文本 → [CPU] 前端 (espeak-ng) → 音素
→ [CPU] Encoder + Duration Predictor → z_p, mask
→ [NPU] Flow Decoder + HiFi-GAN (合并模型) → 音频
piper_tts/
├── tts_pipeline.py # 主推理脚本
├── setup.sh # 板端自动安装
├── models/
│ ├── piper_tts_merged.axmodel # NPU 合并模型 (10.3MB)
│ ├── full_model.onnx # CPU 编码器 (60MB)
│ └── full_model.onnx.json # 音素映射配置
└── espeak-ng-data/ # espeak-ng 语言数据
1# 1. 安装依赖
2pip3 install piper-tts onnxruntime
3
4# 2. 上传文件到板端
5scp -r models/ espeak-ng-data/ tts_pipeline.py root@<板子IP>:/root/piper_tts/
6
7# 3. 验证
8ssh root@<板子IP> "cd /root/piper_tts && python3 tts_pipeline.py '你好世界'"
1cd /root/piper_tts
2
3# 基本用法
4python3 tts_pipeline.py "你好世界,欢迎使用AX650 TTS系统。"
5
6# 指定输出文件
7python3 tts_pipeline.py -o greeting.wav "今天天气真不错。"
8
9# 长文本自动分段
10python3 tts_pipeline.py "这是一段比较长的文本,系统会自动分段处理..."