Otimização do processo de aprendizagem da estrutura gráfica de Redes Bayesianas em BigData

FRANÇA, Arilene Santos de

Use este identificador para citar ou linkar para este item: https://repositorio.ufpa.br/jspui/handle/2011/5608

Registro completo de metadados

Campo DC	Valor	Idioma
dc.creator	FRANÇA, Arilene Santos de	-
dc.date.accessioned	2014-09-05T12:32:05Z	-
dc.date.available	2014-09-05T12:32:05Z	-
dc.date.issued	2014-02-20	-
dc.identifier.citation	FRANÇA, Arilene Santos de. Otimização do processo de aprendizagem da estrutura gráfica de Redes Bayesianas em BigData. Orientador: Ádamo Lima de Santana. 2014. 41 f. Dissertação (Mestrado em Engenharia Elétrica.) - Instituto de Tecnologia, Universidade Federal do Pará, Belém, 2014. Disponível em: http://repositorio.ufpa.br/jspui/handle/2011/5608. Acesso em:.	pt_BR
dc.identifier.uri	http://repositorio.ufpa.br/jspui/handle/2011/5608	-
dc.description.abstract	Automation at data management and analysis has been a crucial factor for companies which need efficient solutions in an each more competitive corporate world. The explosion of the volume information, which has remained increasing in recent years, has demanded more and more commitment to seek strategies to manage and, especially, to extract valuable strategic informations from the use of data mining algorithms, which commonly need to perform exhausting queries at the database in order to obtain statistics that solve or optimize the parameters of the model of knowledge discovery selected; process which requires intensive computing to perform calculations and frequent access to the database. Given the effectiveness of uncertainty treatment, Bayesian networks have been widely used for this process, however, as the amount of data (records and/or attributes) increases, it becomes even more costly and time consuming to extract relevant information in a knowledge base. The goal of this work is to propose a new approach to optimization of the Bayesian Network structure learning in the context of BigData, by using the MapReduce process, in order to improve the processing time. To that end, it was generated a new methodology that includes the creation of an Intermediary Database, containing all the necessary probabilities to the calculations of the network structure. Through the analyzes presented at this work, it is shown that the combination of the proposed methodology with the MapReduce process is a good alternative to solve the scalability problem of the search frequency steps of K2 algorithm and, as a result, to reduce the response time generation of the network.	pt_BR
dc.description.provenance	Submitted by Cleide Dantas (cleidedantas@ufpa.br) on 2014-07-31T13:38:32Z No. of bitstreams: 2 license_rdf: 23898 bytes, checksum: e363e809996cf46ada20da1accfcd9c7 (MD5) Dissertacao_OtimizacaoProcessoAprendizagem.pdf: 1776244 bytes, checksum: 70399c027bdcfb2e5676cb7cc2b4d049 (MD5)	en
dc.description.provenance	Approved for entry into archive by Ana Rosa Silva (arosa@ufpa.br) on 2014-09-05T12:32:05Z (GMT) No. of bitstreams: 2 license_rdf: 23898 bytes, checksum: e363e809996cf46ada20da1accfcd9c7 (MD5) Dissertacao_OtimizacaoProcessoAprendizagem.pdf: 1776244 bytes, checksum: 70399c027bdcfb2e5676cb7cc2b4d049 (MD5)	en
dc.description.provenance	Made available in DSpace on 2014-09-05T12:32:05Z (GMT). No. of bitstreams: 2 license_rdf: 23898 bytes, checksum: e363e809996cf46ada20da1accfcd9c7 (MD5) Dissertacao_OtimizacaoProcessoAprendizagem.pdf: 1776244 bytes, checksum: 70399c027bdcfb2e5676cb7cc2b4d049 (MD5) Previous issue date: 2014	en
dc.description.sponsorship	CAPES - Coordenação de Aperfeiçoamento de Pessoal de Nível Superior	-
dc.language.iso	por	pt_BR
dc.publisher	Universidade Federal do Pará	-
dc.rights	Acesso Aberto	-
dc.subject	Redes bayesianas	pt_BR
dc.subject	BigDATA	pt_BR
dc.subject	Mineração de dados (Computação)	pt_BR
dc.subject	Bayesian networks	en
dc.subject	Data mining	en
dc.title	Otimização do processo de aprendizagem da estrutura gráfica de Redes Bayesianas em BigData	pt_BR
dc.type	Dissertação	pt_BR
dc.publisher.country	Brasil	-
dc.publisher.department	Instituto de Tecnologia	-
dc.publisher.initials	UFPA	-
dc.subject.cnpq	CNPQ::CIENCIAS EXATAS E DA TERRA::CIENCIA DA COMPUTACAO::METODOLOGIA E TECNICAS DA COMPUTACAO::LINGUAGENS DE PROGRAMACAO	-
dc.subject.cnpq	CNPQ::CIENCIAS EXATAS E DA TERRA::CIENCIA DA COMPUTACAO::MATEMATICA DA COMPUTACAO::MODELOS ANALITICOS E DE SIMULACAO	-
dc.subject.cnpq	CNPQ::CIENCIAS EXATAS E DA TERRA::PROBABILIDADE E ESTATISTICA::PROBABILIDADE E ESTATISTICA APLICADAS	-
dc.contributor.advisor1	SANTANA, Ádamo Lima de	-
dc.contributor.advisor1Lattes	http://lattes.cnpq.br/4073088744952858	-
dc.creator.Lattes	http://lattes.cnpq.br/6665410111833245	-
dc.description.resumo	A automação na gestão e análise de dados tem sido um fator crucial para as empresas que necessitam de soluções eficientes em um mundo corporativo cada vez mais competitivo. A explosão do volume de informações, que vem se mantendo crescente nos últimos anos, tem exigido cada vez mais empenho em buscar estratégias para gerenciar e, principalmente, extrair informações estratégicas valiosas a partir do uso de algoritmos de Mineração de Dados, que comumente necessitam realizar buscas exaustivas na base de dados a fim de obter estatísticas que solucionem ou otimizem os parâmetros do modelo de extração do conhecimento utilizado; processo que requer computação intensiva para a execução de cálculos e acesso frequente à base de dados. Dada a eficiência no tratamento de incerteza, Redes Bayesianas têm sido amplamente utilizadas neste processo, entretanto, à medida que o volume de dados (registros e/ou atributos) aumenta, torna-se ainda mais custoso e demorado extrair informações relevantes em uma base de conhecimento. O foco deste trabalho é propor uma nova abordagem para otimização do aprendizado da estrutura da Rede Bayesiana no contexto de BigData, por meio do uso do processo de MapReduce, com vista na melhora do tempo de processamento. Para tanto, foi gerada uma nova metodologia que inclui a criação de uma Base de Dados Intermediária contendo todas as probabilidades necessárias para a realização dos cálculos da estrutura da rede. Por meio das análises apresentadas neste estudo, mostra-se que a combinação da metodologia proposta com o processo de MapReduce é uma boa alternativa para resolver o problema de escalabilidade nas etapas de busca em frequência do algoritmo K2 e, consequentemente, reduzir o tempo de resposta na geração da rede.	pt_BR
dc.publisher.program	Programa de Pós-Graduação em Engenharia Elétrica	-
Aparece nas coleções:	Dissertações em Engenharia Elétrica (Mestrado) - PPGEE/ITEC

Arquivos associados a este item:

Arquivo	Descrição	Tamanho	Formato
Dissertacao_OtimizacaoProcessoAprendizagem.pdf		1,74 MB	Adobe PDF	Visualizar/Abrir

Mostrar registro simples do item Recomendar este item Visualizar estatísticas

Este item está licenciado sob uma Licença Creative Commons