Views
No views yet
1from funasr import AutoModel
2
3# Standalone VAD
4model = AutoModel(model="funasr/fsmn-vad", hub="hf", device="cuda")
5result = model.generate(input="long_audio.wav")
6# Returns speech segments: [[start_ms, end_ms], [start_ms, end_ms], ...]
7print(result[0]["value"])1from funasr import AutoModel
2
3# VAD automatically segments long audio before ASR
4model = AutoModel(
5 model="funasr/paraformer-zh",
6 hub="hf",
7 vad_model="funasr/fsmn-vad",
8 device="cuda",
9)
10result = model.generate(input="meeting_2hours.wav")
11print(result[0]["text"])max_single_segment_time)| Property | Value |
|---|---|
| Architecture | FSMN (Feedforward Sequential Memory Network) |
| Sample Rate | 16kHz |
| Modes | Streaming + Offline |