Views
No views yet
nvidia/diar_streaming_sortformer_4spk-v2.1 using mlx-audio version 0.3.2.pip install -U mlx-audio.nemo archive. This repo contains the pre-converted MLX weights.1python -m mlx_audio.vad.models.sortformer.convert \
2 --nemo-path nvidia/diar_streaming_sortformer_4spk-v2.1 \
3 --output-dir ./sortformer-v2.1-mlx1from mlx_audio.vad import load
2
3model = load("mlx-community/diar_streaming_sortformer_4spk-v2.1-fp16")
4
5for result in model.generate_stream("meeting.wav", chunk_duration=5.0, verbose=True):
6 for seg in result.segments:
7 print(f"Speaker {seg.speaker}: {seg.start:.2f}s - {seg.end:.2f}s")1from mlx_audio.vad import load
2
3model = load("mlx-community/diar_streaming_sortformer_4spk-v2.1-fp16")
4result = model.generate("meeting.wav", threshold=0.5, verbose=True)
5print(result.text)1from mlx_audio.vad import load
2
3model = load("mlx-community/diar_streaming_sortformer_4spk-v2.1-fp16")
4state = model.init_streaming_state()
5
6for chunk in mic_stream(): # your audio source
7 result, state = model.feed(chunk, state, sample_rate=16000)
8 for seg in result.segments:
9 print(f"Speaker {seg.speaker}: {seg.start:.2f}s - {seg.end:.2f}s")