O adjustare a modelului
openai/whisper-small pe Date audio colectate în cadrul proiectului TekWill.
Obține următoarele rezultate pe setul de evaluare:
Este un model intenționat pentru transcrierea graiului Moldovenesc în text.
Pentru antrenarea modelului s-au folosit atît date de la
Common Voice, cît și
date colectate în cadrul proiectului.
Am făcut niște testări pe mai multe modele, ca să observăm dacă există un oarecare progres.
whisper small ro
Transcriere de către modelul preantrenat de la Whisper.
whisper small ro
Transcriere de către modelul antrenat numai cu date de la Common Voice.
whisper small ro
Transcriere de către modelul antrenat numai cu datele colectate în cadrul proiectului.
whisper small ro
Transcrierea de către modelul antrenat atît cu date de la Common Voice, cît și cu date colectate în cadrul proiectului.
Am folosit google colab pentru antrenarea modelului.