Conversão do contorno de pitch por divisão de componentes para aplicação em sistemas de conversão de voz
Show simple item record
| dc.contributor |
Universidade Federal de Santa Catarina |
pt_BR |
| dc.contributor.advisor |
Seara, Rui |
pt_BR |
| dc.contributor.author |
Odebrecht Júnior, Marcos |
pt_BR |
| dc.date.accessioned |
2012-10-24T08:27:22Z |
|
| dc.date.available |
2012-10-24T08:27:22Z |
|
| dc.date.issued |
2012-10-24T08:27:22Z |
|
| dc.identifier.other |
275252 |
pt_BR |
| dc.identifier.uri |
http://repositorio.ufsc.br/xmlui/handle/123456789/92392 |
|
| dc.description |
Dissertação [mestrado) - Universidade Federal de Santa Catarina, Centro Tecnológico, Programa de Pós-Graduação em Engenharia Elétrica, Florianópolis, 2009 |
pt_BR |
| dc.description.abstract |
Esta dissertação propõe uma nova técnica de conversão do contorno de pitch para aplicação em sistemas de conversão de voz. O principal objetivo deste trabalho é possibilitar a aplicação do método proposto aos mais diferentes tipos de sistemas de conversão de voz sem que para tanto seja necessário adaptar ou criar um novo banco de sinais de fala. A abordagem proposta considera o algoritmo MOMEL (modelling melody) para dividir o contorno de pitch levando em conta os componentes macroprosódico e microprosódico, sendo que cada um deles é convertido separadamente. A contribuição do componente macroprosódico, obtida pela interpolação dos dados usando a codificação INTSINT (international transcription system for intonation), é então convertida utilizando um modelo de misturas gaussianas (GMM); enquanto, a contribuição do componente microprosódico é convertida por seleção de segmentos de contorno de pitch. Os problemas inerentes à avaliação de desempenho dos sistemas de conversão de voz são discutidos e um parâmetro denominado índice de desempenho é modificado para permitir uma avaliação objetiva da conversão do contorno de pitch. O desempenho do método proposto é confrontado com dois dos métodos mais utilizados na literatura: conversão utilizando normalização gaussiana (GN) e GMM. O desempenho dos diferentes métodos considerados são avaliados através de dois testes subjetivos: de preferência e de similaridade. Os resultados obtidos ratificam a medida adotada, indicando uma preferência pelo método proposto através da melhoria significativa de desempenho frente aos demais métodos avaliados. A flexibilidade da nova abordagem possibilita ampla gama de aplicações nos mais variados tipos de sistemas de conversão de voz. |
pt_BR |
| dc.format.extent |
xii, 54 f.| il., grafs., tabs. |
pt_BR |
| dc.language.iso |
por |
pt_BR |
| dc.subject.classification |
Engenharia eletrica |
pt_BR |
| dc.subject.classification |
Processamento de sinais |
pt_BR |
| dc.subject.classification |
Analise prosodica |
pt_BR |
| dc.subject.classification |
Entonação (Fonética) |
pt_BR |
| dc.subject.classification |
Reconhecimento automatico da voz |
pt_BR |
| dc.subject.classification |
Sistemas de reconhecimento de padrOes |
pt_BR |
| dc.title |
Conversão do contorno de pitch por divisão de componentes para aplicação em sistemas de conversão de voz |
pt_BR |
| dc.type |
Dissertação [mestrado) |
pt_BR |
Files in this item
This item appears in the following Collection(s)
Show simple item record
Search DSpace
Browse
-
All of DSpace
-
This Collection
My Account
Statistics
Compartilhar