Algoritmo rastreador Web especialista nuclear
Autor(a) principal: | |
---|---|
Data de Publicação: | 2013 |
Tipo de documento: | Dissertação |
Título da fonte: | Repositório Institucional do IPEN |
Texto Completo: | http://repositorio.ipen.br/handle/123456789/11785 |
Resumo: | Nos ??ltimos anos a Web obteve um crescimento exponencial, se tornando o maior reposit??rio de informa????es j?? criado pelo homem e representando uma fonte nova e relevante de informa????es potencialmente ??teis para diversas ??reas, inclusive a ??rea nuclear. Entretanto, devido as suas caracter??sticas e, principalmente, devido ao seu grande volume de dados, emerge um problema desafiador relacionado ?? utiliza????o das suas informa????es: a busca e recupera????o informa????es relevantes e ??teis. Este problema ?? tratado por algoritmos de busca e recupera????o de informa????o que trabalham na Web, denominados rastreadores web. Neste trabalho ?? apresentada a pesquisa e desenvolvimento de um algoritmo rastreador que efetua buscas e recupera p??ginas na Web com conte??do textual relacionado ao dom??nio nuclear e seus temas, de forma aut??noma e massiva. Este algoritmo foi projetado sob o modelo de um sistema especialista, possuindo, desta forma, uma base de conhecimento que contem t??picos nucleares e palavras-chave que os definem e um mecanismo de infer??ncia constitu??do por uma rede neural artificial perceptron multicamadas que efetua a estima????o da relev??ncia das p??ginas na Web para um determinado t??pico nuclear, no decorrer do processo de busca, utilizando a base de conhecimento. Deste modo, o algoritmo ?? capaz de, autonomamente, buscar p??ginas na Web seguindo os hiperlinks que as interconectam e recuperar aquelas que s??o mais relevantes para o t??pico nuclear selecionado, emulando a habilidade que um especialista nuclear tem de navegar na Web e verificar informa????es nucleares. Resultados experimentais preliminares apresentam uma precis??o de recupera????o de 80% para o t??pico ??rea nuclear em geral e 72% para o t??pico de energia nuclear, indicando que o algoritmo proposto ?? efetivo e eficiente na busca e recupera????o de informa????es relevantes para o dom??nio nuclear. |
id |
IPEN_b6f62a5776915a544ea79c12340e414b |
---|---|
oai_identifier_str |
oai:repositorio.ipen.br:123456789/11785 |
network_acronym_str |
IPEN |
network_name_str |
Repositório Institucional do IPEN |
repository_id_str |
4510 |
spelling |
Antonio Carlos de Oliveira BarrosoREIS, THIAGO20132014-11-10T10:25:06Z2014-11-10T10:25:06Zhttp://repositorio.ipen.br/handle/123456789/1178510.11606/D.85.2013.tde-07012014-134548Nos ??ltimos anos a Web obteve um crescimento exponencial, se tornando o maior reposit??rio de informa????es j?? criado pelo homem e representando uma fonte nova e relevante de informa????es potencialmente ??teis para diversas ??reas, inclusive a ??rea nuclear. Entretanto, devido as suas caracter??sticas e, principalmente, devido ao seu grande volume de dados, emerge um problema desafiador relacionado ?? utiliza????o das suas informa????es: a busca e recupera????o informa????es relevantes e ??teis. Este problema ?? tratado por algoritmos de busca e recupera????o de informa????o que trabalham na Web, denominados rastreadores web. Neste trabalho ?? apresentada a pesquisa e desenvolvimento de um algoritmo rastreador que efetua buscas e recupera p??ginas na Web com conte??do textual relacionado ao dom??nio nuclear e seus temas, de forma aut??noma e massiva. Este algoritmo foi projetado sob o modelo de um sistema especialista, possuindo, desta forma, uma base de conhecimento que contem t??picos nucleares e palavras-chave que os definem e um mecanismo de infer??ncia constitu??do por uma rede neural artificial perceptron multicamadas que efetua a estima????o da relev??ncia das p??ginas na Web para um determinado t??pico nuclear, no decorrer do processo de busca, utilizando a base de conhecimento. Deste modo, o algoritmo ?? capaz de, autonomamente, buscar p??ginas na Web seguindo os hiperlinks que as interconectam e recuperar aquelas que s??o mais relevantes para o t??pico nuclear selecionado, emulando a habilidade que um especialista nuclear tem de navegar na Web e verificar informa????es nucleares. Resultados experimentais preliminares apresentam uma precis??o de recupera????o de 80% para o t??pico ??rea nuclear em geral e 72% para o t??pico de energia nuclear, indicando que o algoritmo proposto ?? efetivo e eficiente na busca e recupera????o de informa????es relevantes para o dom??nio nuclear.Submitted by Claudinei Pracidelli (cpracide@ipen.br) on 2014-11-10T10:25:06Z No. of bitstreams: 0Made available in DSpace on 2014-11-10T10:25:06Z (GMT). No. of bitstreams: 0Disserta????o (Mestrado em Tecnologia Nuclear)IPEN/DInstituto de Pesquisas Energeticas e Nucleares - IPEN-CNEN/SP60algorithmscomputer codesexpert systemsinformation retrievalknowledge managementneural networksnuclear data collectionspublic informationwebsitesAlgoritmo rastreador Web especialista nuclearNuclear expert Web algorithminfo:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/masterThesisNS??o Pauloinfo:eu-repo/semantics/openAccessreponame:Repositório Institucional do IPENinstname:Instituto de Pesquisas Energéticas e Nucleares (IPEN)instacron:IPEN20151T007: / R375aREIS, THIAGO14-11http://www.teses.usp.br/teses/disponiveis/85/85133/tde-07012014-134548/pt-br.php10207REIS, THIAGO:10207:-1:SLICENSElicense.txtlicense.txttext/plain; charset=utf-81748http://repositorio.ipen.br/bitstream/123456789/11785/1/license.txt8a4605be74aa9ea9d79846c1fba20a33MD51123456789/117852020-06-11 17:37:56.583oai:repositorio.ipen.br:123456789/11785Tk9URTogUExBQ0UgWU9VUiBPV04gTElDRU5TRSBIRVJFClRoaXMgc2FtcGxlIGxpY2Vuc2UgaXMgcHJvdmlkZWQgZm9yIGluZm9ybWF0aW9uYWwgcHVycG9zZXMgb25seS4KCk5PTi1FWENMVVNJVkUgRElTVFJJQlVUSU9OIExJQ0VOU0UKCkJ5IHNpZ25pbmcgYW5kIHN1Ym1pdHRpbmcgdGhpcyBsaWNlbnNlLCB5b3UgKHRoZSBhdXRob3Iocykgb3IgY29weXJpZ2h0Cm93bmVyKSBncmFudHMgdG8gRFNwYWNlIFVuaXZlcnNpdHkgKERTVSkgdGhlIG5vbi1leGNsdXNpdmUgcmlnaHQgdG8gcmVwcm9kdWNlLAp0cmFuc2xhdGUgKGFzIGRlZmluZWQgYmVsb3cpLCBhbmQvb3IgZGlzdHJpYnV0ZSB5b3VyIHN1Ym1pc3Npb24gKGluY2x1ZGluZwp0aGUgYWJzdHJhY3QpIHdvcmxkd2lkZSBpbiBwcmludCBhbmQgZWxlY3Ryb25pYyBmb3JtYXQgYW5kIGluIGFueSBtZWRpdW0sCmluY2x1ZGluZyBidXQgbm90IGxpbWl0ZWQgdG8gYXVkaW8gb3IgdmlkZW8uCgpZb3UgYWdyZWUgdGhhdCBEU1UgbWF5LCB3aXRob3V0IGNoYW5naW5nIHRoZSBjb250ZW50LCB0cmFuc2xhdGUgdGhlCnN1Ym1pc3Npb24gdG8gYW55IG1lZGl1bSBvciBmb3JtYXQgZm9yIHRoZSBwdXJwb3NlIG9mIHByZXNlcnZhdGlvbi4KCllvdSBhbHNvIGFncmVlIHRoYXQgRFNVIG1heSBrZWVwIG1vcmUgdGhhbiBvbmUgY29weSBvZiB0aGlzIHN1Ym1pc3Npb24gZm9yCnB1cnBvc2VzIG9mIHNlY3VyaXR5LCBiYWNrLXVwIGFuZCBwcmVzZXJ2YXRpb24uCgpZb3UgcmVwcmVzZW50IHRoYXQgdGhlIHN1Ym1pc3Npb24gaXMgeW91ciBvcmlnaW5hbCB3b3JrLCBhbmQgdGhhdCB5b3UgaGF2ZQp0aGUgcmlnaHQgdG8gZ3JhbnQgdGhlIHJpZ2h0cyBjb250YWluZWQgaW4gdGhpcyBsaWNlbnNlLiBZb3UgYWxzbyByZXByZXNlbnQKdGhhdCB5b3VyIHN1Ym1pc3Npb24gZG9lcyBub3QsIHRvIHRoZSBiZXN0IG9mIHlvdXIga25vd2xlZGdlLCBpbmZyaW5nZSB1cG9uCmFueW9uZSdzIGNvcHlyaWdodC4KCklmIHRoZSBzdWJtaXNzaW9uIGNvbnRhaW5zIG1hdGVyaWFsIGZvciB3aGljaCB5b3UgZG8gbm90IGhvbGQgY29weXJpZ2h0LAp5b3UgcmVwcmVzZW50IHRoYXQgeW91IGhhdmUgb2J0YWluZWQgdGhlIHVucmVzdHJpY3RlZCBwZXJtaXNzaW9uIG9mIHRoZQpjb3B5cmlnaHQgb3duZXIgdG8gZ3JhbnQgRFNVIHRoZSByaWdodHMgcmVxdWlyZWQgYnkgdGhpcyBsaWNlbnNlLCBhbmQgdGhhdApzdWNoIHRoaXJkLXBhcnR5IG93bmVkIG1hdGVyaWFsIGlzIGNsZWFybHkgaWRlbnRpZmllZCBhbmQgYWNrbm93bGVkZ2VkCndpdGhpbiB0aGUgdGV4dCBvciBjb250ZW50IG9mIHRoZSBzdWJtaXNzaW9uLgoKSUYgVEhFIFNVQk1JU1NJT04gSVMgQkFTRUQgVVBPTiBXT1JLIFRIQVQgSEFTIEJFRU4gU1BPTlNPUkVEIE9SIFNVUFBPUlRFRApCWSBBTiBBR0VOQ1kgT1IgT1JHQU5JWkFUSU9OIE9USEVSIFRIQU4gRFNVLCBZT1UgUkVQUkVTRU5UIFRIQVQgWU9VIEhBVkUKRlVMRklMTEVEIEFOWSBSSUdIVCBPRiBSRVZJRVcgT1IgT1RIRVIgT0JMSUdBVElPTlMgUkVRVUlSRUQgQlkgU1VDSApDT05UUkFDVCBPUiBBR1JFRU1FTlQuCgpEU1Ugd2lsbCBjbGVhcmx5IGlkZW50aWZ5IHlvdXIgbmFtZShzKSBhcyB0aGUgYXV0aG9yKHMpIG9yIG93bmVyKHMpIG9mIHRoZQpzdWJtaXNzaW9uLCBhbmQgd2lsbCBub3QgbWFrZSBhbnkgYWx0ZXJhdGlvbiwgb3RoZXIgdGhhbiBhcyBhbGxvd2VkIGJ5IHRoaXMKbGljZW5zZSwgdG8geW91ciBzdWJtaXNzaW9uLgo=Repositório InstitucionalPUBhttp://repositorio.ipen.br/oai/requestbibl@ipen.bropendoar:45102020-06-11T17:37:56Repositório Institucional do IPEN - Instituto de Pesquisas Energéticas e Nucleares (IPEN)false |
dc.title.pt_BR.fl_str_mv |
Algoritmo rastreador Web especialista nuclear |
dc.title.alternative.pt_BR.fl_str_mv |
Nuclear expert Web algorithm |
title |
Algoritmo rastreador Web especialista nuclear |
spellingShingle |
Algoritmo rastreador Web especialista nuclear REIS, THIAGO algorithms computer codes expert systems information retrieval knowledge management neural networks nuclear data collections public information websites |
title_short |
Algoritmo rastreador Web especialista nuclear |
title_full |
Algoritmo rastreador Web especialista nuclear |
title_fullStr |
Algoritmo rastreador Web especialista nuclear |
title_full_unstemmed |
Algoritmo rastreador Web especialista nuclear |
title_sort |
Algoritmo rastreador Web especialista nuclear |
author |
REIS, THIAGO |
author_facet |
REIS, THIAGO |
author_role |
author |
dc.contributor.advisor1.fl_str_mv |
Antonio Carlos de Oliveira Barroso |
dc.contributor.author.fl_str_mv |
REIS, THIAGO |
contributor_str_mv |
Antonio Carlos de Oliveira Barroso |
dc.subject.por.fl_str_mv |
algorithms computer codes expert systems information retrieval knowledge management neural networks nuclear data collections public information websites |
topic |
algorithms computer codes expert systems information retrieval knowledge management neural networks nuclear data collections public information websites |
description |
Nos ??ltimos anos a Web obteve um crescimento exponencial, se tornando o maior reposit??rio de informa????es j?? criado pelo homem e representando uma fonte nova e relevante de informa????es potencialmente ??teis para diversas ??reas, inclusive a ??rea nuclear. Entretanto, devido as suas caracter??sticas e, principalmente, devido ao seu grande volume de dados, emerge um problema desafiador relacionado ?? utiliza????o das suas informa????es: a busca e recupera????o informa????es relevantes e ??teis. Este problema ?? tratado por algoritmos de busca e recupera????o de informa????o que trabalham na Web, denominados rastreadores web. Neste trabalho ?? apresentada a pesquisa e desenvolvimento de um algoritmo rastreador que efetua buscas e recupera p??ginas na Web com conte??do textual relacionado ao dom??nio nuclear e seus temas, de forma aut??noma e massiva. Este algoritmo foi projetado sob o modelo de um sistema especialista, possuindo, desta forma, uma base de conhecimento que contem t??picos nucleares e palavras-chave que os definem e um mecanismo de infer??ncia constitu??do por uma rede neural artificial perceptron multicamadas que efetua a estima????o da relev??ncia das p??ginas na Web para um determinado t??pico nuclear, no decorrer do processo de busca, utilizando a base de conhecimento. Deste modo, o algoritmo ?? capaz de, autonomamente, buscar p??ginas na Web seguindo os hiperlinks que as interconectam e recuperar aquelas que s??o mais relevantes para o t??pico nuclear selecionado, emulando a habilidade que um especialista nuclear tem de navegar na Web e verificar informa????es nucleares. Resultados experimentais preliminares apresentam uma precis??o de recupera????o de 80% para o t??pico ??rea nuclear em geral e 72% para o t??pico de energia nuclear, indicando que o algoritmo proposto ?? efetivo e eficiente na busca e recupera????o de informa????es relevantes para o dom??nio nuclear. |
publishDate |
2013 |
dc.date.pt_BR.fl_str_mv |
2013 |
dc.date.accessioned.fl_str_mv |
2014-11-10T10:25:06Z |
dc.date.available.fl_str_mv |
2014-11-10T10:25:06Z |
dc.type.status.fl_str_mv |
info:eu-repo/semantics/publishedVersion |
dc.type.driver.fl_str_mv |
info:eu-repo/semantics/masterThesis |
format |
masterThesis |
status_str |
publishedVersion |
dc.identifier.uri.fl_str_mv |
http://repositorio.ipen.br/handle/123456789/11785 |
dc.identifier.doi.none.fl_str_mv |
10.11606/D.85.2013.tde-07012014-134548 |
url |
http://repositorio.ipen.br/handle/123456789/11785 |
identifier_str_mv |
10.11606/D.85.2013.tde-07012014-134548 |
dc.rights.driver.fl_str_mv |
info:eu-repo/semantics/openAccess |
eu_rights_str_mv |
openAccess |
dc.format.none.fl_str_mv |
60 |
dc.coverage.pt_BR.fl_str_mv |
N |
dc.source.none.fl_str_mv |
reponame:Repositório Institucional do IPEN instname:Instituto de Pesquisas Energéticas e Nucleares (IPEN) instacron:IPEN |
instname_str |
Instituto de Pesquisas Energéticas e Nucleares (IPEN) |
instacron_str |
IPEN |
institution |
IPEN |
reponame_str |
Repositório Institucional do IPEN |
collection |
Repositório Institucional do IPEN |
bitstream.url.fl_str_mv |
http://repositorio.ipen.br/bitstream/123456789/11785/1/license.txt |
bitstream.checksum.fl_str_mv |
8a4605be74aa9ea9d79846c1fba20a33 |
bitstream.checksumAlgorithm.fl_str_mv |
MD5 |
repository.name.fl_str_mv |
Repositório Institucional do IPEN - Instituto de Pesquisas Energéticas e Nucleares (IPEN) |
repository.mail.fl_str_mv |
bibl@ipen.br |
_version_ |
1767254200491704320 |