Conversão de fala sussurrada para fala normal usando modelos neurais

Registro completo de metadados
MetadadosDescriçãoIdioma
Autor(es): dc.contributorScalassara, Paulo Rogerio-
Autor(es): dc.contributorhttp://lattes.cnpq.br/5016119298122922-
Autor(es): dc.contributorAgulhari, Cristiano Marcos-
Autor(es): dc.contributorhttp://lattes.cnpq.br/4935395556663775-
Autor(es): dc.contributorSpatti, Danilo Hernane-
Autor(es): dc.contributorhttp://lattes.cnpq.br/7371885828178292-
Autor(es): dc.contributorScalassara, Paulo Rogerio-
Autor(es): dc.contributorhttp://lattes.cnpq.br/5016119298122922-
Autor(es): dc.contributorBarbon Junior, Sylvio-
Autor(es): dc.creatorYamamura, Cezar Fumio-
Data de aceite: dc.date.accessioned2025-08-29T12:25:57Z-
Data de disponibilização: dc.date.available2025-08-29T12:25:57Z-
Data de envio: dc.date.issued2022-11-27-
Data de envio: dc.date.issued2022-11-27-
Data de envio: dc.date.issued2021-11-16-
Fonte completa do material: dc.identifierhttp://repositorio.utfpr.edu.br/jspui/handle/1/30188-
Fonte: dc.identifier.urihttp://educapes.capes.gov.br/handle/capes/1095223-
Descrição: dc.descriptionWhispering is a common and secondary speech mechanism for communicating, however, in some cases, it can also be the main form to communicate, such as cases of people with pathologies of the larynx or who have suffered some type of damage to the vocal folds. Differences in characteristics between normal voice and whispered discussions have raised in speech recognition area, due to the difficulty of converting whispered to normal speech. This work presents the study of the characteristics of normal and whispered speech, and the implementation of the whispered to normal voice conversion system using multilayer perceptron networks and generative adversarial networks. The database used came from the partnership with Faculdade de Porto, which are vowel signs used in European Portuguese. To validate the study, three metrics were analyzed: Mel-Cepstrum Distortion, square root of the mean error of log(F0) and accuracy of the vowel classifier.-
Descrição: dc.descriptionO sussurro é um mecanismo de fala comum e secundário para se comunicar, porém, em alguns casos, pode ser a principal forma de diálogo, como nos casos de pessoas com patologias da laringe ou que sofreram algum tipo de dano nas pregas vocais. As diferenças de características entre a voz normal e a sussurrada têm levantado discussões na área de reconhecimento de fala, pela dificuldade de realizar a conversão de fala sussurrada para fala vozeada. Este trabalho apresenta o estudo das características da fala normal e sussurrada, e a implementação do sistema de conversão de voz normal para sussurrada utilizando redes perceptron multicamadas e redes generativas adversárias. Os dados utilizados foram provenientes pela parceria com Faculdade de Porto, que são sinais de vogais usados no português europeu. Para a validação do estudo, foram analisado três métricas: Mel-Cepstrum Distortion, raiz quadrada do erro médio do log(F0) e acurácia do classificador de vogais.-
Formato: dc.formatapplication/pdf-
Idioma: dc.languagept_BR-
Publicador: dc.publisherUniversidade Tecnológica Federal do Paraná-
Publicador: dc.publisherCornelio Procopio-
Publicador: dc.publisherBrasil-
Publicador: dc.publisherPrograma de Pós-Graduação em Engenharia Elétrica-
Publicador: dc.publisherUTFPR-
Direitos: dc.rightsopenAccess-
Palavras-chave: dc.subjectDistúrbios da fala-
Palavras-chave: dc.subjectRedes Neurais (Computação)-
Palavras-chave: dc.subjectComunicação-
Palavras-chave: dc.subjectSpeech disorders-
Palavras-chave: dc.subjectNeural networks (Computer science)-
Palavras-chave: dc.subjectCommunication-
Palavras-chave: dc.subjectCNPQ::ENGENHARIAS::ENGENHARIA ELETRICA-
Palavras-chave: dc.subjectEngenharia Elétrica-
Título: dc.titleConversão de fala sussurrada para fala normal usando modelos neurais-
Tipo de arquivo: dc.typelivro digital-
Aparece nas coleções:Repositorio Institucional da UTFPR - RIUT

Não existem arquivos associados a este item.