SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.

Detalhes bibliográficos
Autor(a) principal: Prosdocimo, Marcio Zeni
Data de Publicação: 1996
Tipo de documento: Dissertação
Idioma: por
Título da fonte: Biblioteca Digital de Teses e Dissertações da USP
Texto Completo: http://www.teses.usp.br/teses/disponiveis/55/55134/tde-29082017-164102/
Resumo: Neste trabalho, um sistema para transformar texto na língua portuguesa falado no Brasil em voz é, desenvolvido. O método adotado para a transformação é Texto-Fonema-Voz. Este método tem algumas vantagens: (i) ele cria uma Biblioteca de Voz (BV) para qualquer língua ou para todas, independentemente do mapeamento texto para fonemas; (ii) ele pode interconectar-se com outros sistemas que realizem tarefa semelhante. O uso do sistema Máquina Falante é muito diversificado. As pessoas podem usar facilmente os computadores, porque eles tornam-se mais interativos. A técnica utilizada para mapear texto para fonemas é as Redes Neurais Artificiais (RNA). O uso de RNA tem algumas vantagens sobre técnicas convencionais, como dicionário fonético: (i) a quantidade de informação armazenada pela RNA é menor que a quantidade de informação armazenada pelas outras técnicas; (ii) o usuário não necessita fazer manutenção para novas palavras; (iii) o Perceptron Multi-Camadas tem a característica de generalização. Para uma boa generalização, o conjunto de treinamento deve caracterizar todo o universo de discurso. Para a síntese, nós codificamos a, voz humana pela técnica Waveform. Esta técnica foi escolhida porque é simples e sua característica de qualidade é muito relevante. A BV é um conjunto de informações sobre como o processo de síntese produz fisicamente os fonemas ou grupos de fonemas. Cada arquivo da BV representa uma sílaba. A performance da rede utilizada é de aproximadamente 94% de acerto usando um conjunto de teste que foi construído com palavras diferentes das usadas no treinamento, que é considerado, na área, um bom índice de generalização.
id USP_db7346242f8de6770e995cdb55bcd485
oai_identifier_str oai:teses.usp.br:tde-29082017-164102
network_acronym_str USP
network_name_str Biblioteca Digital de Teses e Dissertações da USP
repository_id_str 2721
spelling SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.A system for converting text in voice using neural networks for portuguese languageNão disponívelNot availableNeste trabalho, um sistema para transformar texto na língua portuguesa falado no Brasil em voz é, desenvolvido. O método adotado para a transformação é Texto-Fonema-Voz. Este método tem algumas vantagens: (i) ele cria uma Biblioteca de Voz (BV) para qualquer língua ou para todas, independentemente do mapeamento texto para fonemas; (ii) ele pode interconectar-se com outros sistemas que realizem tarefa semelhante. O uso do sistema Máquina Falante é muito diversificado. As pessoas podem usar facilmente os computadores, porque eles tornam-se mais interativos. A técnica utilizada para mapear texto para fonemas é as Redes Neurais Artificiais (RNA). O uso de RNA tem algumas vantagens sobre técnicas convencionais, como dicionário fonético: (i) a quantidade de informação armazenada pela RNA é menor que a quantidade de informação armazenada pelas outras técnicas; (ii) o usuário não necessita fazer manutenção para novas palavras; (iii) o Perceptron Multi-Camadas tem a característica de generalização. Para uma boa generalização, o conjunto de treinamento deve caracterizar todo o universo de discurso. Para a síntese, nós codificamos a, voz humana pela técnica Waveform. Esta técnica foi escolhida porque é simples e sua característica de qualidade é muito relevante. A BV é um conjunto de informações sobre como o processo de síntese produz fisicamente os fonemas ou grupos de fonemas. Cada arquivo da BV representa uma sílaba. A performance da rede utilizada é de aproximadamente 94% de acerto usando um conjunto de teste que foi construído com palavras diferentes das usadas no treinamento, que é considerado, na área, um bom índice de generalização.In this work, a system to translate Portuguese language text spoken in Brazil into speech is developed. The method adopted for translation is Text-Phoneme-Speech. This method has some advantages: (i) it creates a Speech Library (SL) for any language or for all, independently of text-to-phoneme mapping; (iÐ it can interlink with other systems which would do the same task. The use of the talker system - Máquina Falante - is very diversified. People can use easily the computers, because they become more interactive. The technique utilized to map text into phonemes has been the Artificial Neural Networks (ANN). The use of ANN has some advantages over conventional techniques - like phonetic dictionary: (i) the quantity of information stored by ANN is smaller than the quantity of information stored by other techniques; (ii) the user does not need to make maintenance for new words; (iiÐ Multi-Layer Perceptron has the generalization cha¡acteristic. For a good generalization, the training set must characterize all the universe of mapping. For synthesis, we codified the human speech by Waveform technique. This technique has been chosen because it is simple and its feature of quality is very relevant. The SL is a set of information about how a synthesis process physically produces phonemes or group of phonemes. Each file of SL represents a syllable. Net performance has been around 94% of correctness over a test set which was built with non-training words. This percentage is considerate a good generalization index.Biblioteca Digitais de Teses e Dissertações da USPRomero, Roseli Aparecida FrancelinProsdocimo, Marcio Zeni1996-08-02info:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/masterThesisapplication/pdfhttp://www.teses.usp.br/teses/disponiveis/55/55134/tde-29082017-164102/reponame:Biblioteca Digital de Teses e Dissertações da USPinstname:Universidade de São Paulo (USP)instacron:USPLiberar o conteúdo para acesso público.info:eu-repo/semantics/openAccesspor2018-07-17T16:38:18Zoai:teses.usp.br:tde-29082017-164102Biblioteca Digital de Teses e Dissertaçõeshttp://www.teses.usp.br/PUBhttp://www.teses.usp.br/cgi-bin/mtd2br.plvirginia@if.usp.br|| atendimento@aguia.usp.br||virginia@if.usp.bropendoar:27212018-07-17T16:38:18Biblioteca Digital de Teses e Dissertações da USP - Universidade de São Paulo (USP)false
dc.title.none.fl_str_mv SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
A system for converting text in voice using neural networks for portuguese language
title SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
spellingShingle SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
Prosdocimo, Marcio Zeni
Não disponível
Not available
title_short SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
title_full SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
title_fullStr SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
title_full_unstemmed SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
title_sort SISTEMA PARA TRANSFORMAR TEXTO EM VOZ UTILIZANDOREDES NEURAIS PARA A LINGUA PORTUGUESA.
author Prosdocimo, Marcio Zeni
author_facet Prosdocimo, Marcio Zeni
author_role author
dc.contributor.none.fl_str_mv Romero, Roseli Aparecida Francelin
dc.contributor.author.fl_str_mv Prosdocimo, Marcio Zeni
dc.subject.por.fl_str_mv Não disponível
Not available
topic Não disponível
Not available
description Neste trabalho, um sistema para transformar texto na língua portuguesa falado no Brasil em voz é, desenvolvido. O método adotado para a transformação é Texto-Fonema-Voz. Este método tem algumas vantagens: (i) ele cria uma Biblioteca de Voz (BV) para qualquer língua ou para todas, independentemente do mapeamento texto para fonemas; (ii) ele pode interconectar-se com outros sistemas que realizem tarefa semelhante. O uso do sistema Máquina Falante é muito diversificado. As pessoas podem usar facilmente os computadores, porque eles tornam-se mais interativos. A técnica utilizada para mapear texto para fonemas é as Redes Neurais Artificiais (RNA). O uso de RNA tem algumas vantagens sobre técnicas convencionais, como dicionário fonético: (i) a quantidade de informação armazenada pela RNA é menor que a quantidade de informação armazenada pelas outras técnicas; (ii) o usuário não necessita fazer manutenção para novas palavras; (iii) o Perceptron Multi-Camadas tem a característica de generalização. Para uma boa generalização, o conjunto de treinamento deve caracterizar todo o universo de discurso. Para a síntese, nós codificamos a, voz humana pela técnica Waveform. Esta técnica foi escolhida porque é simples e sua característica de qualidade é muito relevante. A BV é um conjunto de informações sobre como o processo de síntese produz fisicamente os fonemas ou grupos de fonemas. Cada arquivo da BV representa uma sílaba. A performance da rede utilizada é de aproximadamente 94% de acerto usando um conjunto de teste que foi construído com palavras diferentes das usadas no treinamento, que é considerado, na área, um bom índice de generalização.
publishDate 1996
dc.date.none.fl_str_mv 1996-08-02
dc.type.status.fl_str_mv info:eu-repo/semantics/publishedVersion
dc.type.driver.fl_str_mv info:eu-repo/semantics/masterThesis
format masterThesis
status_str publishedVersion
dc.identifier.uri.fl_str_mv http://www.teses.usp.br/teses/disponiveis/55/55134/tde-29082017-164102/
url http://www.teses.usp.br/teses/disponiveis/55/55134/tde-29082017-164102/
dc.language.iso.fl_str_mv por
language por
dc.relation.none.fl_str_mv
dc.rights.driver.fl_str_mv Liberar o conteúdo para acesso público.
info:eu-repo/semantics/openAccess
rights_invalid_str_mv Liberar o conteúdo para acesso público.
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
dc.coverage.none.fl_str_mv
dc.publisher.none.fl_str_mv Biblioteca Digitais de Teses e Dissertações da USP
publisher.none.fl_str_mv Biblioteca Digitais de Teses e Dissertações da USP
dc.source.none.fl_str_mv
reponame:Biblioteca Digital de Teses e Dissertações da USP
instname:Universidade de São Paulo (USP)
instacron:USP
instname_str Universidade de São Paulo (USP)
instacron_str USP
institution USP
reponame_str Biblioteca Digital de Teses e Dissertações da USP
collection Biblioteca Digital de Teses e Dissertações da USP
repository.name.fl_str_mv Biblioteca Digital de Teses e Dissertações da USP - Universidade de São Paulo (USP)
repository.mail.fl_str_mv virginia@if.usp.br|| atendimento@aguia.usp.br||virginia@if.usp.br
_version_ 1815257483277500416