Views
No views yet
| Eval | WER | Latency |
|---|---|---|
| VIVOS-test 50 clips | 5.50% (CER 2.91%) | p50 0.17s / p90 0.18s |
| Long-form 195.6s (1 request, endless_decode) | 6.61% | RTF 0.073 |
| VietMed 38 clips (hội thoại y tế) | 18.81%* | p50 0.30s |
1# pip install chunkformer
2from chunkformer import ChunkFormerModel
3
4model = ChunkFormerModel.from_pretrained("vudang449/chunkformer-large-vie")
5text = model.batch_decode(["audio.wav"])[0] # clip ngắn
6long = model.endless_decode("long.wav", return_timestamps=False) # file dài