Navegando por Assunto "Machine learning"
Agora exibindo 1 - 10 de 30
- Resultados por página
- Opções de Ordenação
Dissertação Acesso aberto (Open Access) 5G MIMO and LIDAR data for machine learning: mmWave beam-selection using deep learning(Universidade Federal do Pará, 2019-08-29) DIAS, Marcus Vinicius de Oliveira; KLAUTAU JÚNIOR, Aldebaro Barreto da Rocha; http://lattes.cnpq.br/1596629769697284Sistemas de comunicação modernos podem explorar o crescente número de dados de sensores usados atualmente em equipamentos avançados e reduzir a sobrecarga associada à configuração de links. Além disso, a crescente complexidade das redes sugere que o aprendizado de máquina, como redes neurais profundas, podem ser utilizadas efetivamente para melhorar as tecnologias 5G. A falta de grandes conjuntos de dados dificulta a investigação da aplicação de aprendizado profundo na comunicação sem fio. Este trabalho apresenta uma metodologia de simulação (RayMobTime) que combina um simulador de tráfego de veículos (SUMO) com um simulador de ray-tracing (Remcom’s Wireless InSite), para gerar canais que representem cenários 5G realísticos, bem como a criação de dados de sensores LIDAR (através do Blensor). O conjunto de dados criado é utilizado para investigar técnicas de beam selection de veículo para infraestrutura usando ondas milimétricas em diferentes arquiteturas, como arquitetura distribuída (uso das informações de apenas um veículo selecionado e processamento de dados no veículo) e arquiteturas centralizadas (uso de todas as informações presentes fornecidas pelos sensores em um dado momento, processando na estação base). Os resultados indicam que redes neurais profundas convolucionais podem ser utilizadas para beam selection sob uma estrutura de classificação de top-M. Também mostra que uma arquitetura distribuída baseada em LIDAR fornece desempenho robusto independentemente da taxa de penetração de veículos, superando outras arquiteturas, bem como pode ser usada para detecção de visada direta com precisão razoável.Tese Acesso aberto (Open Access) Abordagem Inteligente com Combinação de Características Estruturais para Detecção de Novas Famílias de Ransomware(Universidade Federal do Pará, 2024-03-22) MOREIRA, Caio Carvalho; SALES JÚNIOR, Claudomiro de Souza de; País de Nacionalidade BrasiRansomware é um software malicioso que tem como objetivo criptografar os arquivos do usuá- rio e exigir um resgate para desbloqueá-los. Trata-se de uma ameaça cibernética que pode causar significativos danos financeiros, além do comprometimento de privacidade e integridade dos dados. Embora os scanners de detecção baseados em assinaturas comumente combatam essa ameaça, eles falham na identificação de famílias (variantes) desconhecidas de ransomware. Um método para detectar novas ameaças sem a necessidade de executá-las é a análise estática, que inspeciona o código e a estrutura do software, juntamente com a classificação através de abordagens inteligentes. A Detecção de Novas Famílias de Ransomware (DNFR) pode ser avaliada em um cenário realista e desafiador pela categorização e isolamento de famílias para treinamento e teste. Desta forma, o objetivo desta tese é desenvolver um modelo eficaz de análise estática para a DNFR, que pode ser aplicado em sistemas Windows como uma camada adicional de segurança para verificar os arquivos executáveis no momento do recebimento ou antes de sua execução. A detecção precoce do ransomware é fundamental para reduzir a probabilidade de um ataque bem-sucedido. A abordagem proposta analisa abrangentemente os binários executá- veis, ao extrair e combinar diversas características estruturais, e os distingue entre ransomware ou software benigno empregando um modelo de votação suave que compreende três técnicas de Aprendizado de Máquina: Logistic Regression (LR), Random Forest (RF) e eXtreme Gradient Boosting (XGB). Os resultados para a DNFR demonstraram médias de 97,53% de acurácia, 96,36% de precisão, 97,52% de recall e 96,41% de F-measure. Além disso, a varredura e a predição de amostras individuais levaram uma média de 0,37 segundos. Essa performance indica sucesso na identificação rápida de variantes desconhecidas de ransomware e na adaptabilidade do modelo ao cenário em constante evolução, o que sugere sua aplicabilidade em sistemas de proteção antivírus, mesmo em dispositivos com recursos limitados. Portanto, o método oferece vantagens significativas e pode ajudar desenvolvedores de sistemas de detecção de ransomware na criação de soluções mais resilientes, confiáveis e com rápido tempo de resposta.Tese Acesso aberto (Open Access) Aplicação de redes neurais artificiais para predição de RSSI e SNR em ambiente de bosque amazônico(Universidade Federal do Pará, 2024-06-11) BARBOSA, Brenda Silvana de Souza; ARAÚJO, Jasmine Priscyla Leite de; http://lattes.cnpq.br/4001747699670004; https://orcid.org/0000-0003-3514-0401; BARROS, Fabrício José Brito; http://lattes.cnpq.br/9758585938727609A presença de áreas verdes em cidades urbanizadas é crucial para reduzir os impactos negativos da urbanização. No entanto, essas áreas podem influenciar a qualidade do sinal de dispositivos IoT que utilizam comunicação sem fio, como a tecnologia LoRa. A vegetação atenua as ondas eletromagnéticas, interferindo na transmissão de dados entre dispositivos IoT, resultando na necessidade de modelagem de propagação de sinal que considere o efeito da vegetação em sua propagação. Neste contexto, esta pesquisa foi conduzida na Universidade Federal do Pará, utilizando medições em um ambiente arborizado composto pela espécie Pau-Mulato, típica da Amazônia. Dois modelos de propagação baseados em aprendizado de máquina, GRNN e MLPNN, foram desenvolvidos para considerar o efeito das árvores amazônicas na propagação, analisando diferentes fatores, como a altura do transmissor em relação ao tronco, o início da folhagem e o meio da copa da árvore, bem como o fator de espalhamento LoRa (SF) 12 e a copolarização das antenas do transmissor e do receptor. Os melhores modelos foram os de aprendizado de máquina, GRNN e MLPNN, que demonstraram maior precisão, alcançando valores de erro quadrático médio (RMSE) de 3,86 dB e 3,8614 dB, e desvio padrão (SD) de 3,8558 dB e 3,8564 dB, respectivamente. Por outro lado, comparando com modelos clássicos da literatura, o que teve melhor desempenho foi o modelo Floating Intercept (FI), com erro RMSE e SD em torno de 7,74 dB e 7,77 dB, respectivamente, enquanto o modelo FITU-R teve o maior erro RMSE e SD, em torno de 26,40 dB e 9,65 dB, respectivamente, para todas as alturas e polarizações. Além disso, a importância deste estudo reside em seu potencial para impulsionar as comunicações sem fio em ambientes arborizados, uma vez que, mesmo em distâncias curtas nas alturas de 12 m e 18 m, o SNR (relação sinal ruído) teve valores mais baixos devido à influência das folhagens, porém, foi possível enviar e receber dados. Por fim, foi mostrado que a polarização vertical foi a que obteve os melhores resultados para o ambiente de bosque amazônicoDissertação Acesso aberto (Open Access) Aplicação e comparação de técnicas de classificação automática de documentos: um estudo de caso com o dataset do domínio jurídico “Victor”(Universidade Federal do Pará, 2024-02-01) MARTINS, Victor Simões; SILVA, Cleison Daniel; http://lattes.cnpq.br/1445401605385329; https://orcid.org/0000-0001-8280-2928A aplicação do Processamento de Linguagem Natural (PLN) e Inteligência Artifical (IA) no contexto jurídico brasileiro é uma área em franco crescimento, que pode alterar o modo e rotina de trabalho dos profissionais da área, dada a quantidade de texto gerada. Dentre as possibilidades de aplicação da PLN e IA há a classificação automática de documentos, que dentre outras, pode ser empregada na automatização do processo de digitalização de Processos Judiciais que ainda estão apenas em meio físico. Assim, este trabalho aplica e compara algoritmos de IA para a classificação de documentos jurídicos. Os algoritmos são divididos em duas Abordagens diferentes, a primeira (I) separa o processo representação computacional do texto do treinamento do classificador em si aplicando SVM e Regressão Logística em conjunto com representações computacionais baseadas em: TF-IDF, Word2Vec, FastText e BERT. A segunda Abordagem (II) realiza em conjunto a representação computacional dos documentos e o treinamento do classificador, e para tal são aplicados algoritmos de Deep Learning baseados em redes neurais recorrentes, especificamente o ULMFiT (Universal Language Model Fine-tuning) e HAN (Hierarchical Attention Networks). O Dataset estudado é denominado VICTOR, composto por documentos do Supremo Tribunal Federal (STF) do Brasil. A pesquisa conclui pela possibilidade de aplicação de ambas abordagens para a classificação de documentos jurídicos do Dataset empregado, bem como, apesar de menos custosos computacionalmente, os pipelines de classificação da Abordagem I que empregam a representação computacional do documento com TF-IDF apresentam resultados equivalentes aos pipelines que empregam Deep Learning. Além disso, a especialização da representação computacional dos documentos com os dados do dataset em estudo, melhoram o desempenho dos pipelines que empregam Word2Vec, FastText e ULMFiT, quando comparados aos pipelines que aplicam as representações genéricas desses, ou seja, modelos pré-treinados com dados do contexto geral.Dissertação Acesso aberto (Open Access) Arquitetura de modelos híbridos, machine learning e otimizadores para análise de consumo de energia elétrica e produtividade em pintura automotiva(Universidade Federal do Pará, 2024-03-27) OLIVEIRA, Rafael Barbosa de; OLIVEIRA, Roberto Célio Limão de; http://lattes.cnpq.br/4497607460894318Estratégias de otimização de consumo energético nas etapas de pintura emergem como fatores primordiais para promover uma produção mais sustentável e competitiva no setor automotivo. Esta dissertação busca prever o consumo energético e maximizar a produtividade na pintura automotiva, utilizando uma abordagem que combina seleção de variáveis, modelos híbridos, hiperparâmetros destes modelos e otimização por meta-heurística em uma arquitetura com 3 etapas. Os processos de pintura automotiva apresentam variáveis em forma de séries temporais que descrevem o histórico do consumo de energia. Na etapa 1, escolhe-se o melhor modelo de aprendizado de máquina (Random Forest, Long-Short Term Memory, XGBoost e GRU-LSTM) para prever séries temporais do consumo energético em t+1. Na etapa 2, avalia-se os modelos RF, XGBoost e Rede Neural Artificial (RNA) Densa para selecionar o melhor preditor de quantidade de veículos produzidos (ciclos). Na etapa 3, seleciona-se a melhor meta-heurística entre Genetic Algorithm (GA), Differential Evolution (DE) e Particle Swarm Optimization (PSO) para otimizar o consumo energético previsto pelo melhor modelo do step 1, usando como medida de fitness o melhor modelo do step 2. A arquitetura final reduziu a energia consumida em até 16% e aumentou o ciclo em 127%, usando os modelos GRU-LSTM na etapa 1, RNA Densa na etapa 2 e DE no etapa 3. Os resultados ressaltam a oportunidade de uso da abordagem proposta para otimizar o consumo de enrgia e a produtividade na pintura automotiva.Dissertação Acesso aberto (Open Access) Beam-selection otimizado por aprendizado de máquina : uma abordagem multimodal(Universidade Federal do Pará, 2023-12-30) FERREIRA, Jamelly Freitas; GOMES, Diego de Azevedo; http://lattes.cnpq.br/5116561408505726; KLAUTAU JÚNIOR, Aldebaro Barreto da Rocha; http://lattes.cnpq.br/1596629769697284Esta dissertação tem como objetivo investigar a utilização de modelos de aprendizado de máquina usando dados multimodais como entrada para otimizar o processo de “Beam-Selection”em redes baseadas em ondas milimétricas. O uso de Deep Learning tem se intensificado em diferentes áreas, sendo possível obter performance igual ou superior à humana, desta forma seu uso mostra-se promissor também em cenários de comunicação sem fio. Neste trabalho foram usados dados de diferentes naturezas o que se mostrou conveniente ao passo que é possível ajustar o modelo de acordo com a qualidade/disponibilidade destes dados. Após execução dos experimentos, e obtencão dos resultados, foi observado que é possível obter significativa performance em diferentes métricas, mesmo com dados mais simples como Imagem e Coordenada.Dissertação Acesso aberto (Open Access) Classificação de eletroencefalogramas epiléticos em estado de repouso com aplicação de classificadores lineares e um atributo derivado da densidade espectral de potência(Universidade Federal do Pará, 2019-12-04) FIEL, José de Santana; PEREIRA JÚNIOR, Antônio ; http://lattes.cnpq.br/3239362677711162Milhões de brasileiros são afetados pela epilepsia e o acesso ao diagnóstico precoce é crucial para o seu tratamento adequado. No entanto, o diagnóstico de epilepsia depende da avaliação de registros eletroencefalográficos (EEG) de longa duração realizados por profissionais treinados, transformando-o em um processo oneroso que não está imediatamente disponível para muitos pacientes no Brasil. Assim, o presente trabalho propõe uma metodologia para a classificação automática do EEG de indivíduos epiléticos, que utiliza registros de EEG de curta duração obtidos com o paciente em repouso. O sistema é baseado em algoritmos de aprendizado de máquina que usam um atributo extraído da densidade espectral de potência dos sinais de EEG. Esse atributo é uma estimativa da conectividade funcional entre os pares de canais de EEG e é chamado debiased weighted phase-lag index (dWPLI). Os algoritmos de classificação foram análise discriminante linear (LDA) e máquinas de vetores de suporte (SVM). Os sinais de EEG foram adquiridos durante o estado interictal, isto é, entre convulsões e não tinham atividade epileptiforme. Registros EEG 11 pacientes epiléticos e 7 indivíduos saudáveis foram utilizados para avaliar o desempenho do método proposto. Ambos os algoritmos atingiram seu desempenho máximo de classificação, 100 % de precisão e área sob a curva de característica de operação do receptor (AUROC), quando um vetor de característica com 190 atributos foi usado como entrada. Os resultados mostram a eficácia do sistema proposto, dado seu alto desempenho de classificação.Dissertação Acesso aberto (Open Access) Clusterização de padrões espaço-temporais de precipitação na Amazônia via deep convolutional autoencoder(Universidade Federal do Pará, 2023-07-07) SILVA, Vander Augusto Oliveira da; TEIXEIRA, Raphael Barros; http://lattes.cnpq.br/4902824086591521; https://orcid.org/0000-0003-2993-802XEstudos utilizando diferentes métodos de aprendizado de máquina para descoberta de conhecimento e reconhecimento de padrões em séries temporais de precipitação são cada vez mais frequentes na literatura. Identificar e analisar padrões em séries temporais de precipitação em uma determinada região é fundamental para seu desenvolvimento socioeconômico. Logo, pode-se afirmar que o conhecimento e compreensão das características pluviométricas das regiões são importantes para viabilizar o planejamento do uso, manejo e conservação dos recursos hídricos. O fenômeno natural da precipitação é um processo fundamental de impacto direto nas bacias hidrográficas e no desenvolvimento humano e ambiental. A variabilidade desse fenômeno produz implicações importantes na navegabilidade dos rios, sobre a abundância do indivíduo e a riqueza das espécies. Nos últimos anos muitos estudos com essa abordagem foram realizados no Brasil, principalmente na região amazônica. Esta pesquisa teve como objetivo desenvolvimento de um método computacional para análise de séries temporais de precipitação utilizando técnicas de machine learning com aprendizado não supervisionado, afim de propor um método capaz de realizar a extração de características complexas dos dados, obtendo um mapa de atributos em baixa dimensionalidade para reconhecimento de padrões, descoberta de regiões homogêneas com relação à precipitação e reconstrução aproximada de séries temporais de precipitação da Amazônia Legal. O modelo de rede neural de aprendizado profundo proposto é treinado para aprender as principais e mais complexas características dos dados originais e apresentá-los em baixa dimensionalidade no espaço latente. Após o treinamento os resultados se mostram promissores, as observações dos dados reconstruídos apresentaram um bom desempenho conforme avaliação da métrica de RMSE e NRMSE com valores resultantes iguais a 0.06610 e 0.3355 respectivamente. A análise da representação dos dados em baixa dimensão foi aplicada e analisada por uma estrutura de clustering usando aglomerativo hierárquico com método de Ward. Essa metodologia também apresentou bons resultados, pois realizou agrupamentos consistentes caracterizando regiões homogêneas com relação aos dados de precipitação. Desta forma, demonstrando que a representação em baixa dimensionalidade carregava as características principais das séries temporais dos dados analisados. Destaca-se que o método desenvolvido nesse estudo pode ser aplicado não apenas na região amazônica, mas também em outras áreas com desafios semelhantes relacionados à análise de séries temporais.Dissertação Acesso aberto (Open Access) Conversão grafema-fone para um sistema de reconhecimento de voz com suporte a grandes vocabulários para o português brasileiro(Universidade Federal do Pará, 2006-06-12) HOSN, Chadia Nadim Aboul; KLAUTAU JÚNIOR, Aldebaro Barreto da Rocha; http://lattes.cnpq.br/1596629769697284O processamento de voz tornou-se uma tecnologia cada vez mais baseada na modelagem automática de vasta quantidade de dados. Desta forma, o sucesso das pesquisas nesta área está diretamente ligado a existência de corpora de domínio público e outros recursos específicos, tal como um dicionário fonético. No Brasil, ao contrário do que acontece para a língua inglesa, por exemplo, não existe atualmente em domínio público um sistema de Reconhecimento Automático de Voz (RAV) para o Português Brasileiro com suporte a grandes vocabulários. Frente a este cenário, o trabalho tem como principal objetivo discutir esforços dentro da iniciativa FalaBrasil [1], criada pelo Laboratório de Processamento de Sinais (LaPS) da UFPA, apresentando pesquisas e softwares na área de RAV para o Português do Brasil. Mais especificamente, o presente trabalho discute a implementação de um sistema de reconhecimento de voz com suporte a grandes vocabulários para o Português do Brasil, utilizando a ferramenta HTK baseada em modelo oculto de Markov (HMM) e a criação de um módulo de conversão grafema-fone, utilizando técnicas de aprendizado de máquina.Tese Acesso aberto (Open Access) Custo de oportunidade (trade-off) para diferentes estratégias de manutenção de trilhos ferroviários na Amazônia(Universidade Federal do Pará, 2022-12-22) CURCINO, Gabrielle dos Anjos; BRAGA, Eduardo de Magalhães; http://lattes.cnpq.br/4783553888547500A manutenção emergencial dos ativos ferroviários na Amazônia brasileira tem gerado perdas de receita e custos de oportunidade. O objetivo geral deste estudo foi identificar a importância do custo de oportunidade na tomada de decisão para estratégias de manutenção corretiva e preventiva. A metodologia propôs a modelagem das variáveis referentes aos dados econômicos e operacionais da manutenção ferroviária nos últimos dez anos, por aprendizado de máquina não paramétrico Gradient Boosting Regression Tree, e hibridizando-o com a análise do custo de oportunidade para o trade-off decisão de uma ferrovia de minério na Amazônia brasileira. Os resultados mostraram que o GBDT foi eficiente em ajustar os dados de treinamento com r2 igual a um. Da mesma forma, os dados do teste apresentaram valores de r2 satisfatórios, próximos a um, onde se obteve o grau de importância das variáveis independentes na predição das variáveis dependentes. O método de Pearson foi utilizado para construir a matriz de correlação para cada par de variáveis. A partir do modelo gerado, foram criados oito grupos de previsão para o ano de 2022. Em seguida, foram estabelecidos níveis de conflito, sugeridos pela literatura econômica, entre os cenários de previsão, onde o custo de oportunidade foi identificado entre as alternativas com melhor benefício às estratégias de manutenção. Dessa forma, o custo de oportunidade aliado ao aprendizado de máquina serve como um instrumento para auxiliar as empresas na busca por melhores decisões de manutenção, o que contribui para o aprimoramento da gestão dos ativos ferroviários. O estudo do custo de oportunidade a partir de uma análise trade off baseada em predições do custo das estratégias de manutenção através da modelagem por Machine Learning - Gradient Boosting Regression é um objetivo inédito na literatura.
- «
- 1 (current)
- 2
- 3
- »
