Views
No views yet

git clone git@github.com:nguyenvulebinh/MSA-ASR.git
cd MSA-ASR
conda create -n MSA-ASR python=3.10
conda activate MSA-ASR
pip install -r requirements.txtpython infer.py
1spk_1 A 0.00 1.58 »spk_1
2spk_1 A 0.00 1.58 Pacifica
3spk_1 A 1.58 0.68 continues
4spk_1 A 2.27 0.52 today
5spk_1 A 2.79 0.24 to
6spk_1 A 3.03 0.20 be
7spk_1 A 3.23 0.14 a
8spk_1 A 3.37 0.54 listener
9spk_1 A 3.91 0.80 supported
10spk_1 A 4.71 0.70 network
11spk_1 A 5.42 0.38 of
12spk_2 A 5.80 0.12 »spk_2
13spk_2 A 5.80 0.12 At
14spk_2 A 5.92 0.42 home,
15spk_2 A 6.34 0.18 an
16spk_2 A 6.52 0.38 Aed
17spk_2 A 6.90 0.26 is
18spk_2 A 7.16 0.18 an
19spk_2 A 7.34 0.56 automated
20spk_2 A 7.90 0.60 external
21spk_2 A 8.50 0.90 defibrillator.
22spk_2 A 9.40 0.40 It's
23spk_2 A 9.81 0.08 the
24spk_2 A 9.89 0.36 device
25spk_2 A 10.25 0.08 you
26spk_2 A 10.33 0.16 use
27spk_2 A 10.49 0.12 when
28spk_2 A 10.61 0.10 your
29spk_2 A 10.73 0.16 heart
30spk_2 A 10.89 0.18 goes
31spk_2 A 11.07 0.12 into
32spk_2 A 11.19 0.38 cardiac
33spk_2 A 11.57 0.38 arrest
34spk_2 A 11.95 0.18 to
35spk_2 A 12.13 0.36 shock
36spk_2 A 12.49 0.14 it
37spk_2 A 12.63 0.28 back
38spk_2 A 12.91 0.22 into
39spk_2 A 13.13 0.06 a
40spk_2 A 13.19 0.32 normal
41spk_2 A 13.51 0.88 rhythm.
42spk_1 A 14.40 1.38 »spk_1
43spk_1 A 14.40 1.38 stations.1@INPROCEEDINGS{10889116,
2 author={Nguyen, Thai-Binh and Waibel, Alexander},
3 booktitle={ICASSP 2025 - 2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)},
4 title={MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models},
5 year={2025},
6 volume={},
7 number={},
8 pages={1-5},
9 keywords={Training;Adaptation models;Limiting;Predictive models;Data models;Robustness;Multilingual;Data mining;Speech processing;Standards;speaker-attributed;asr;multilingual},
10 doi={10.1109/ICASSP49660.2025.10889116}}
11
12@INPROCEEDINGS{10446589,
13 author={Nguyen, Thai-Binh and Waibel, Alexander},
14 booktitle={ICASSP 2024 - 2024 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)},
15 title={Synthetic Conversations Improve Multi-Talker ASR},
16 year={2024},
17 volume={},
18 number={},
19 pages={10461-10465},
20 keywords={Systematics;Error analysis;Knowledge based systems;Oral communication;Signal processing;Data models;Acoustics;multi-talker;asr;synthetic conversation},
21 doi={10.1109/ICASSP48485.2024.10446589}}
22
23[Binh Nguyen](nguyenvulebinh[at]gmail.com)