Conversão do contorno de pitch por divisão de componentes para aplicação em sistemas de conversão de voz

DSpace Repository

A- A A+

Conversão do contorno de pitch por divisão de componentes para aplicação em sistemas de conversão de voz

Show simple item record

dc.contributor Universidade Federal de Santa Catarina pt_BR
dc.contributor.advisor Seara, Rui pt_BR
dc.contributor.author Odebrecht Júnior, Marcos pt_BR
dc.date.accessioned 2012-10-24T08:27:22Z
dc.date.available 2012-10-24T08:27:22Z
dc.date.issued 2012-10-24T08:27:22Z
dc.identifier.other 275252 pt_BR
dc.identifier.uri http://repositorio.ufsc.br/xmlui/handle/123456789/92392
dc.description Dissertação [mestrado) - Universidade Federal de Santa Catarina, Centro Tecnológico, Programa de Pós-Graduação em Engenharia Elétrica, Florianópolis, 2009 pt_BR
dc.description.abstract Esta dissertação propõe uma nova técnica de conversão do contorno de pitch para aplicação em sistemas de conversão de voz. O principal objetivo deste trabalho é possibilitar a aplicação do método proposto aos mais diferentes tipos de sistemas de conversão de voz sem que para tanto seja necessário adaptar ou criar um novo banco de sinais de fala. A abordagem proposta considera o algoritmo MOMEL (modelling melody) para dividir o contorno de pitch levando em conta os componentes macroprosódico e microprosódico, sendo que cada um deles é convertido separadamente. A contribuição do componente macroprosódico, obtida pela interpolação dos dados usando a codificação INTSINT (international transcription system for intonation), é então convertida utilizando um modelo de misturas gaussianas (GMM); enquanto, a contribuição do componente microprosódico é convertida por seleção de segmentos de contorno de pitch. Os problemas inerentes à avaliação de desempenho dos sistemas de conversão de voz são discutidos e um parâmetro denominado índice de desempenho é modificado para permitir uma avaliação objetiva da conversão do contorno de pitch. O desempenho do método proposto é confrontado com dois dos métodos mais utilizados na literatura: conversão utilizando normalização gaussiana (GN) e GMM. O desempenho dos diferentes métodos considerados são avaliados através de dois testes subjetivos: de preferência e de similaridade. Os resultados obtidos ratificam a medida adotada, indicando uma preferência pelo método proposto através da melhoria significativa de desempenho frente aos demais métodos avaliados. A flexibilidade da nova abordagem possibilita ampla gama de aplicações nos mais variados tipos de sistemas de conversão de voz. pt_BR
dc.format.extent xii, 54 f.| il., grafs., tabs. pt_BR
dc.language.iso por pt_BR
dc.subject.classification Engenharia eletrica pt_BR
dc.subject.classification Processamento de sinais pt_BR
dc.subject.classification Analise prosodica pt_BR
dc.subject.classification Entonação (Fonética) pt_BR
dc.subject.classification Reconhecimento automatico da voz pt_BR
dc.subject.classification Sistemas de reconhecimento de padrOes pt_BR
dc.title Conversão do contorno de pitch por divisão de componentes para aplicação em sistemas de conversão de voz pt_BR
dc.type Dissertação [mestrado) pt_BR


Files in this item

Files Size Format View
275252.pdf 848.4Kb PDF Thumbnail

This item appears in the following Collection(s)

Show simple item record

Search DSpace


Browse

My Account

Statistics

Compartilhar