Navegando por Assunto "Aprendizado de máquina"
Agora exibindo 1 - 10 de 30
- Resultados por página
- Opções de Ordenação
Dissertação Acesso aberto (Open Access) 5G MIMO and LIDAR data for machine learning: mmWave beam-selection using deep learning(Universidade Federal do Pará, 2019-08-29) DIAS, Marcus Vinicius de Oliveira; KLAUTAU JÚNIOR, Aldebaro Barreto da Rocha; http://lattes.cnpq.br/1596629769697284Sistemas de comunicação modernos podem explorar o crescente número de dados de sensores usados atualmente em equipamentos avançados e reduzir a sobrecarga associada à configuração de links. Além disso, a crescente complexidade das redes sugere que o aprendizado de máquina, como redes neurais profundas, podem ser utilizadas efetivamente para melhorar as tecnologias 5G. A falta de grandes conjuntos de dados dificulta a investigação da aplicação de aprendizado profundo na comunicação sem fio. Este trabalho apresenta uma metodologia de simulação (RayMobTime) que combina um simulador de tráfego de veículos (SUMO) com um simulador de ray-tracing (Remcom’s Wireless InSite), para gerar canais que representem cenários 5G realísticos, bem como a criação de dados de sensores LIDAR (através do Blensor). O conjunto de dados criado é utilizado para investigar técnicas de beam selection de veículo para infraestrutura usando ondas milimétricas em diferentes arquiteturas, como arquitetura distribuída (uso das informações de apenas um veículo selecionado e processamento de dados no veículo) e arquiteturas centralizadas (uso de todas as informações presentes fornecidas pelos sensores em um dado momento, processando na estação base). Os resultados indicam que redes neurais profundas convolucionais podem ser utilizadas para beam selection sob uma estrutura de classificação de top-M. Também mostra que uma arquitetura distribuída baseada em LIDAR fornece desempenho robusto independentemente da taxa de penetração de veículos, superando outras arquiteturas, bem como pode ser usada para detecção de visada direta com precisão razoável.Tese Acesso aberto (Open Access) Abordagem Inteligente com Combinação de Características Estruturais para Detecção de Novas Famílias de Ransomware(Universidade Federal do Pará, 2024-03-22) MOREIRA, Caio Carvalho; SALES JÚNIOR, Claudomiro de Souza de; País de Nacionalidade BrasiRansomware é um software malicioso que tem como objetivo criptografar os arquivos do usuá- rio e exigir um resgate para desbloqueá-los. Trata-se de uma ameaça cibernética que pode causar significativos danos financeiros, além do comprometimento de privacidade e integridade dos dados. Embora os scanners de detecção baseados em assinaturas comumente combatam essa ameaça, eles falham na identificação de famílias (variantes) desconhecidas de ransomware. Um método para detectar novas ameaças sem a necessidade de executá-las é a análise estática, que inspeciona o código e a estrutura do software, juntamente com a classificação através de abordagens inteligentes. A Detecção de Novas Famílias de Ransomware (DNFR) pode ser avaliada em um cenário realista e desafiador pela categorização e isolamento de famílias para treinamento e teste. Desta forma, o objetivo desta tese é desenvolver um modelo eficaz de análise estática para a DNFR, que pode ser aplicado em sistemas Windows como uma camada adicional de segurança para verificar os arquivos executáveis no momento do recebimento ou antes de sua execução. A detecção precoce do ransomware é fundamental para reduzir a probabilidade de um ataque bem-sucedido. A abordagem proposta analisa abrangentemente os binários executá- veis, ao extrair e combinar diversas características estruturais, e os distingue entre ransomware ou software benigno empregando um modelo de votação suave que compreende três técnicas de Aprendizado de Máquina: Logistic Regression (LR), Random Forest (RF) e eXtreme Gradient Boosting (XGB). Os resultados para a DNFR demonstraram médias de 97,53% de acurácia, 96,36% de precisão, 97,52% de recall e 96,41% de F-measure. Além disso, a varredura e a predição de amostras individuais levaram uma média de 0,37 segundos. Essa performance indica sucesso na identificação rápida de variantes desconhecidas de ransomware e na adaptabilidade do modelo ao cenário em constante evolução, o que sugere sua aplicabilidade em sistemas de proteção antivírus, mesmo em dispositivos com recursos limitados. Portanto, o método oferece vantagens significativas e pode ajudar desenvolvedores de sistemas de detecção de ransomware na criação de soluções mais resilientes, confiáveis e com rápido tempo de resposta.Dissertação Acesso aberto (Open Access) Análise e classificação de severidade de COVID-19 usando aprendizado de máquina(Universidade Federal do Pará, 2022-08-16) LIMA, Marco Antonio Loureiro; CARDOSO, Diego Lisboa; http://lattes.cnpq.br/0507944343674734Nos últimos anos, com o crescimento alarmante de casos de COVID-19, uma doença viral altamente contagiosa, fez-se necessário novas formas de diagnóstico e controle desta enfermidade a fim de que a sua propagação seja reduzida até que a população seja vacinada efetivamente. Neste contexto, Inteligência Artificial (IA) e seus subcampos surgem como possíveis alternativas para auxiliar no combate da doença por meio de análises de sintomas relacionados a esta patologia. Alguns métodos de Aprendizado de Máquina (AM) são mostrados como resposta para essa doença, contribuindo com a análise baseada em um conjunto de sintomas apresentados pelo paciente e consequentemente auxiliando o diagnóstico, bem como agilizando o processo de tratamento. Para atingir esse objetivo são propostos três modelos que utilizam esses métodos de AM para predizer a severidade de COVID-19 em graus distintos. Os resultados em cada um destes modelos são avaliados através de métricas estabelecidas ao longo deste trabalho. No mais, diferentes sugestões são mostradas para melhorar a análise e realizar predições com maior acurácia.Dissertação Acesso aberto (Open Access) Aplicação e comparação de técnicas de classificação automática de documentos: um estudo de caso com o dataset do domínio jurídico “Victor”(Universidade Federal do Pará, 2024-02-01) MARTINS, Victor Simões; SILVA, Cleison Daniel; http://lattes.cnpq.br/1445401605385329; https://orcid.org/0000-0001-8280-2928A aplicação do Processamento de Linguagem Natural (PLN) e Inteligência Artifical (IA) no contexto jurídico brasileiro é uma área em franco crescimento, que pode alterar o modo e rotina de trabalho dos profissionais da área, dada a quantidade de texto gerada. Dentre as possibilidades de aplicação da PLN e IA há a classificação automática de documentos, que dentre outras, pode ser empregada na automatização do processo de digitalização de Processos Judiciais que ainda estão apenas em meio físico. Assim, este trabalho aplica e compara algoritmos de IA para a classificação de documentos jurídicos. Os algoritmos são divididos em duas Abordagens diferentes, a primeira (I) separa o processo representação computacional do texto do treinamento do classificador em si aplicando SVM e Regressão Logística em conjunto com representações computacionais baseadas em: TF-IDF, Word2Vec, FastText e BERT. A segunda Abordagem (II) realiza em conjunto a representação computacional dos documentos e o treinamento do classificador, e para tal são aplicados algoritmos de Deep Learning baseados em redes neurais recorrentes, especificamente o ULMFiT (Universal Language Model Fine-tuning) e HAN (Hierarchical Attention Networks). O Dataset estudado é denominado VICTOR, composto por documentos do Supremo Tribunal Federal (STF) do Brasil. A pesquisa conclui pela possibilidade de aplicação de ambas abordagens para a classificação de documentos jurídicos do Dataset empregado, bem como, apesar de menos custosos computacionalmente, os pipelines de classificação da Abordagem I que empregam a representação computacional do documento com TF-IDF apresentam resultados equivalentes aos pipelines que empregam Deep Learning. Além disso, a especialização da representação computacional dos documentos com os dados do dataset em estudo, melhoram o desempenho dos pipelines que empregam Word2Vec, FastText e ULMFiT, quando comparados aos pipelines que aplicam as representações genéricas desses, ou seja, modelos pré-treinados com dados do contexto geral.Dissertação Acesso aberto (Open Access) Arquitetura de modelos híbridos, machine learning e otimizadores para análise de consumo de energia elétrica e produtividade em pintura automotiva(Universidade Federal do Pará, 2024-03-27) OLIVEIRA, Rafael Barbosa de; OLIVEIRA, Roberto Célio Limão de; http://lattes.cnpq.br/4497607460894318Estratégias de otimização de consumo energético nas etapas de pintura emergem como fatores primordiais para promover uma produção mais sustentável e competitiva no setor automotivo. Esta dissertação busca prever o consumo energético e maximizar a produtividade na pintura automotiva, utilizando uma abordagem que combina seleção de variáveis, modelos híbridos, hiperparâmetros destes modelos e otimização por meta-heurística em uma arquitetura com 3 etapas. Os processos de pintura automotiva apresentam variáveis em forma de séries temporais que descrevem o histórico do consumo de energia. Na etapa 1, escolhe-se o melhor modelo de aprendizado de máquina (Random Forest, Long-Short Term Memory, XGBoost e GRU-LSTM) para prever séries temporais do consumo energético em t+1. Na etapa 2, avalia-se os modelos RF, XGBoost e Rede Neural Artificial (RNA) Densa para selecionar o melhor preditor de quantidade de veículos produzidos (ciclos). Na etapa 3, seleciona-se a melhor meta-heurística entre Genetic Algorithm (GA), Differential Evolution (DE) e Particle Swarm Optimization (PSO) para otimizar o consumo energético previsto pelo melhor modelo do step 1, usando como medida de fitness o melhor modelo do step 2. A arquitetura final reduziu a energia consumida em até 16% e aumentou o ciclo em 127%, usando os modelos GRU-LSTM na etapa 1, RNA Densa na etapa 2 e DE no etapa 3. Os resultados ressaltam a oportunidade de uso da abordagem proposta para otimizar o consumo de enrgia e a produtividade na pintura automotiva.Dissertação Acesso aberto (Open Access) Beam-selection otimizado por aprendizado de máquina : uma abordagem multimodal(Universidade Federal do Pará, 2023-12-30) FERREIRA, Jamelly Freitas; GOMES, Diego de Azevedo; http://lattes.cnpq.br/5116561408505726; KLAUTAU JÚNIOR, Aldebaro Barreto da Rocha; http://lattes.cnpq.br/1596629769697284Esta dissertação tem como objetivo investigar a utilização de modelos de aprendizado de máquina usando dados multimodais como entrada para otimizar o processo de “Beam-Selection”em redes baseadas em ondas milimétricas. O uso de Deep Learning tem se intensificado em diferentes áreas, sendo possível obter performance igual ou superior à humana, desta forma seu uso mostra-se promissor também em cenários de comunicação sem fio. Neste trabalho foram usados dados de diferentes naturezas o que se mostrou conveniente ao passo que é possível ajustar o modelo de acordo com a qualidade/disponibilidade destes dados. Após execução dos experimentos, e obtencão dos resultados, foi observado que é possível obter significativa performance em diferentes métricas, mesmo com dados mais simples como Imagem e Coordenada.Dissertação Acesso aberto (Open Access) Classificação de eletroencefalogramas epiléticos em estado de repouso com aplicação de classificadores lineares e um atributo derivado da densidade espectral de potência(Universidade Federal do Pará, 2019-12-04) FIEL, José de Santana; PEREIRA JÚNIOR, Antônio ; http://lattes.cnpq.br/3239362677711162Milhões de brasileiros são afetados pela epilepsia e o acesso ao diagnóstico precoce é crucial para o seu tratamento adequado. No entanto, o diagnóstico de epilepsia depende da avaliação de registros eletroencefalográficos (EEG) de longa duração realizados por profissionais treinados, transformando-o em um processo oneroso que não está imediatamente disponível para muitos pacientes no Brasil. Assim, o presente trabalho propõe uma metodologia para a classificação automática do EEG de indivíduos epiléticos, que utiliza registros de EEG de curta duração obtidos com o paciente em repouso. O sistema é baseado em algoritmos de aprendizado de máquina que usam um atributo extraído da densidade espectral de potência dos sinais de EEG. Esse atributo é uma estimativa da conectividade funcional entre os pares de canais de EEG e é chamado debiased weighted phase-lag index (dWPLI). Os algoritmos de classificação foram análise discriminante linear (LDA) e máquinas de vetores de suporte (SVM). Os sinais de EEG foram adquiridos durante o estado interictal, isto é, entre convulsões e não tinham atividade epileptiforme. Registros EEG 11 pacientes epiléticos e 7 indivíduos saudáveis foram utilizados para avaliar o desempenho do método proposto. Ambos os algoritmos atingiram seu desempenho máximo de classificação, 100 % de precisão e área sob a curva de característica de operação do receptor (AUROC), quando um vetor de característica com 190 atributos foi usado como entrada. Os resultados mostram a eficácia do sistema proposto, dado seu alto desempenho de classificação.Dissertação Acesso aberto (Open Access) Classificação de ransomware utilizando MLP, redução de dimensionalidade e balanceamento de classes(Universidade Federal do Pará, 2023-07-03) PEREIRA, George Tassiano Melo; SALES JÚNIOR, Claudomiro de Souza de; http://lattes.cnpq.br/4742268936279649Ransomware é um tipo de malware que impede ou limita o acesso do usuário ao sistema e arquivos até que um resgate seja pago. Combater essa ameaça é difícil devido à sua disseminação rápida e às constantes mudanças nas técnicas de criptografia utilizadas. Algoritmos de aprendizado de máquina, como Redes Neurais Artificiais, têm sido apontados como ferramentas promissoras na classificação de ransomware, porque elas podem aprender a identificar padrões e características complexas em grandes quantidades de dados. Isso permite que as redes neurais sejam treinadas com exemplos de amostras de software malicioso, incluindo ransomware, e depois sejam capazes de classificar novos exemplos com alta precisão. Além disso, as redes neurais também são capazes de aprender e se adaptar a mudanças no comportamento do malware, tornando-as ferramentas eficazes para a detecção de novos tipos de ransomware. Neste trabalho, é explorado três tipos de classificação de ransomware por RNA dentro de um pipeline composto com redução de dimensionalidade por Kernel PCA e balanceamento de classes com a abordagem de superamostragem aleatória. A MLP ( Multi-layer Perceptron) alcançou uma média de 98% de acurácia na classificação binária e 85% de acurácia na classificação de família com goodware, onde tais valores superam os resultados anteriores e demonstram assim a eficácia da inclusão do balanceamento de classes na melhoria do modelo de detecção de ransomware.Dissertação Acesso aberto (Open Access) Clusterização de padrões espaço-temporais de precipitação na Amazônia via deep convolutional autoencoder(Universidade Federal do Pará, 2023-07-07) SILVA, Vander Augusto Oliveira da; TEIXEIRA, Raphael Barros; http://lattes.cnpq.br/4902824086591521; https://orcid.org/0000-0003-2993-802XEstudos utilizando diferentes métodos de aprendizado de máquina para descoberta de conhecimento e reconhecimento de padrões em séries temporais de precipitação são cada vez mais frequentes na literatura. Identificar e analisar padrões em séries temporais de precipitação em uma determinada região é fundamental para seu desenvolvimento socioeconômico. Logo, pode-se afirmar que o conhecimento e compreensão das características pluviométricas das regiões são importantes para viabilizar o planejamento do uso, manejo e conservação dos recursos hídricos. O fenômeno natural da precipitação é um processo fundamental de impacto direto nas bacias hidrográficas e no desenvolvimento humano e ambiental. A variabilidade desse fenômeno produz implicações importantes na navegabilidade dos rios, sobre a abundância do indivíduo e a riqueza das espécies. Nos últimos anos muitos estudos com essa abordagem foram realizados no Brasil, principalmente na região amazônica. Esta pesquisa teve como objetivo desenvolvimento de um método computacional para análise de séries temporais de precipitação utilizando técnicas de machine learning com aprendizado não supervisionado, afim de propor um método capaz de realizar a extração de características complexas dos dados, obtendo um mapa de atributos em baixa dimensionalidade para reconhecimento de padrões, descoberta de regiões homogêneas com relação à precipitação e reconstrução aproximada de séries temporais de precipitação da Amazônia Legal. O modelo de rede neural de aprendizado profundo proposto é treinado para aprender as principais e mais complexas características dos dados originais e apresentá-los em baixa dimensionalidade no espaço latente. Após o treinamento os resultados se mostram promissores, as observações dos dados reconstruídos apresentaram um bom desempenho conforme avaliação da métrica de RMSE e NRMSE com valores resultantes iguais a 0.06610 e 0.3355 respectivamente. A análise da representação dos dados em baixa dimensão foi aplicada e analisada por uma estrutura de clustering usando aglomerativo hierárquico com método de Ward. Essa metodologia também apresentou bons resultados, pois realizou agrupamentos consistentes caracterizando regiões homogêneas com relação aos dados de precipitação. Desta forma, demonstrando que a representação em baixa dimensionalidade carregava as características principais das séries temporais dos dados analisados. Destaca-se que o método desenvolvido nesse estudo pode ser aplicado não apenas na região amazônica, mas também em outras áreas com desafios semelhantes relacionados à análise de séries temporais.Dissertação Acesso aberto (Open Access) Conversão grafema-fone para um sistema de reconhecimento de voz com suporte a grandes vocabulários para o português brasileiro(Universidade Federal do Pará, 2006-06-12) HOSN, Chadia Nadim Aboul; KLAUTAU JÚNIOR, Aldebaro Barreto da Rocha; http://lattes.cnpq.br/1596629769697284O processamento de voz tornou-se uma tecnologia cada vez mais baseada na modelagem automática de vasta quantidade de dados. Desta forma, o sucesso das pesquisas nesta área está diretamente ligado a existência de corpora de domínio público e outros recursos específicos, tal como um dicionário fonético. No Brasil, ao contrário do que acontece para a língua inglesa, por exemplo, não existe atualmente em domínio público um sistema de Reconhecimento Automático de Voz (RAV) para o Português Brasileiro com suporte a grandes vocabulários. Frente a este cenário, o trabalho tem como principal objetivo discutir esforços dentro da iniciativa FalaBrasil [1], criada pelo Laboratório de Processamento de Sinais (LaPS) da UFPA, apresentando pesquisas e softwares na área de RAV para o Português do Brasil. Mais especificamente, o presente trabalho discute a implementação de um sistema de reconhecimento de voz com suporte a grandes vocabulários para o Português do Brasil, utilizando a ferramenta HTK baseada em modelo oculto de Markov (HMM) e a criação de um módulo de conversão grafema-fone, utilizando técnicas de aprendizado de máquina.
- «
- 1 (current)
- 2
- 3
- »
