Bem-vindo à documentação do modelo REF, uma solução de Reconhecimento de Emoções na Fala desenvolvida por VanessaMartinsG.
Descrição
O modelo REF foi treinado utilizando um conjunto de dados de áudios brasileiros categorizados em Felicidade, Raiva, Medo, Tristeza e Neutro. O conjunto de dados foi gentilmente disponibilizado por um estudante de mestrado, contribuindo para fortalecer a comunidade de Processamento de Linguagem Natural (PLN) brasileira.
Nota Importante:
Devido à escassez de recursos e dados disponíveis na comunidade PLN brasileira, o modelo foi treinado com um conjunto de áudios relativamente limitado. Utilizando a arquitetura ResNet34, o modelo alcançou um desempenho notável no reconhecimento de emoções.
Modo de usar
O modelo está disponível como um arquivo chamado 'audio_emotion_model' que você pode baixar e incorporar em seu projeto.
Baixe o Modelo:
Faça o download do arquivo binário do modelo REF disponível aqui. Certifique-se de incluir este arquivo no diretório de modelos do seu sistema.
Integre o Modelo ao Código:
Caso você esteja utilizando o sistema REFT que disponibilizei no github, o arquivo deve estar localizado dentro da pasta REF/modelo, seguindo a arquitetura abaixo:
Se você estiver interessado no código completo, sinta-se à vontade para visitar meu repositório no GitHub: REFT
Contribuição
Sinta-se à vontade para contribuir, relatar problemas ou fazer sugestões para melhorar este projeto. Aceitamos contribuições por meio de pull requests.
Informação Adicional
Este trabalho foi desenvolvido como resultado da tese de graduação da aluna Vanessa Martins da Universidade do Estado da Bahia (UNEB). Para mais detalhes, a monografia completa pode ser consultada no repositório da universidade.