Views
No views yet
bin/ 下可执行文件,无需编译)| 模型 | 采样率 | axmodel | 降噪 | Python RTF | C++ RTF |
|---|---|---|---|---|---|
| fastenhancer_t_16k | 16 kHz | 148 KB | RMS -13% | 0.21 | 0.02 |
| fastenhancer_t_48k | 48 kHz | 153 KB | RMS -12% | 0.34 | 0.05 |
RTF = 推理总耗时 / 音频时长(不含模型加载,AX650 板端实测,Python N=10 / C++ N=3 平均)。口径为端到端enhance():CPU STFT/压缩 + NPU 核 + 解压/ISTFT 全链路。 RTF < 1.0 即可实时。
FastEnhancer.AXERA/
├── models/
│ ├── 16k/ # 16kHz axmodel + model_meta.json
│ └── 48k/ # 48kHz axmodel + model_meta.json
├── bin/ # C++ 可执行文件(板端直接运行,无需编译)
│ ├── fastenhancer_ax650_16k
│ └── fastenhancer_ax650_48k
├── python/ # Python SDK
│ ├── fastenhancer_sdk/ # inference.py + 16k/ 48k/ STFT 窗
│ ├── demo.py # 降噪 demo
│ └── requirements.txt # numpy + pyaxengine
├── run_ax650.sh # 一键运行脚本(16k/48k,Python 或 C++)
├── samples/ # 降噪前后对比音频
└── README.md1# 下载本仓库到板端后:
2bash run_ax650.sh 16k # 16kHz C++ 一键降噪
3bash run_ax650.sh 48k # 48kHz C++ 一键降噪
4bash run_ax650.sh 16k python # 16kHz Python 降噪output_16k_enhanced.wav / output_48k_enhanced.wav(输入默认为
samples/p232_013_original.wav)。1conda create -n fastenhancer python=3.10
2conda activate fastenhancer
3
4# 安装 pyaxengine (https://github.com/AXERA-TECH/pyaxengine/releases/latest)
5pip install axengine-x.x.x-py3-none-any.whl
6
7pip install -r python/requirements.txt1cd python
2# 16kHz
3python3 demo.py --model ../models/16k/model.axmodel --input noisy.wav --output enhanced.wav
4# 48kHz
5python3 demo.py --model ../models/48k/model.axmodel --input noisy.wav --output enhanced.wavbin/ 下的可执行文件已按 AX650 交叉编译好,板端直接运行,无需编译:1# 16kHz
2./bin/fastenhancer_ax650_16k models/16k/model.axmodel noisy.wav enhanced.wav
3# 48kHz
4./bin/fastenhancer_ax650_48k models/48k/model.axmodel noisy.wav enhanced.wav/soc/lib,系统已配置搜索路径,一般直接运行即可;如提示找不到
libax_*.so,再加 export LD_LIBRARY_PATH=/soc/lib:${LD_LIBRARY_PATH:-}。p232_013_original.wav — 原始嘈杂语音p232_013_16k_core_onnx.wav — 16kHz ONNX 参考降噪p232_013_16k_board_enhanced.wav — 16kHz AX650 板端降噪输出p232_013_48k_core_onnx.wav — 48kHz ONNX 参考降噪p232_013_48k_board_enhanced.wav — 48kHz AX650 板端降噪输出