Detecção de Malware
Android com Machine
Learning
Introdução
Com a popularização da Internet das Coisas, 5G e outras tecnologias, os
dispositivos inteligentes móveis estão se desenvolvendo rapidamente, e a
quantidade de aplicativos Android instalados em terminais inteligentes, como
telefones celulares e tablets, também está aumentando.
Junto a isso tem sido visto um aumento nos malwares direcionados à plataforma.
Otimização e Processamento de Dados
• O processamento de dados percorre todo o processo de detecção de malware
Android baseado em aprendizado de máquina, incluindo não apenas o
processamento de amostras coletadas de aplicativos Android, mas também o
processamento do conjunto de características extraídas dessas amostras.
Definindo o método
• O design do algoritmo deve ser mais inclinado para técnicas mistas e multi-
níveis. O tema da detecção de malwares no Android pode ser avaliado por
diferentes perspectivas, como processamento de imagem, processamento de
linguagem natural e mineração de dados.
Outra direção de pesquisa que não pode ser ignorada no aprendizado de
máquina é a deriva de conceito com o tempo, devido ao contínuo
desenvolvimento e evolução de malwares no Android o desempenho
preditivo de um classificador treinado diminui.
Ferramentas e Resultados
• Framework Transcend – Concept Drift
• DroidSpan
• DroidEvolver
• Acurácia de 21 a 37%
Deep Learning na
Detecção de Cyberbullying em
Mídias Sociais
Introdução
• Neste estudo, foram adotadas técnicas de visualização para explorar as
palavras mais frequentes em um conjunto de dados de detecção de
cyberbullying, usando uma técnica chamada de nuvem de palavras.
• O Word Cloud exibe as palavras mais frequentes presentes em tweets
codificados, revelando que nos tweets ofensivos, há nomes de políticos,
nomes de condados, palavras desrespeitosas e algumas palavras normais
que, quando combinadas, formam frases ofensivas
Método
• Uso de quatro métricas (precisão, F-medida, recall e acurácia)
• O método foi testado em diferentes divisões de treinamento-teste (75-25%,
50-50%, 30-70%, 20-80% e 10-90%), demonstrando uma queda de
desempenho à medida que o número de amostras de treinamento diminui. A
comparação com outros oito algoritmos de aprendizado de máquina mostra
que o método proposto supera os demais em termos de acurácia.
Conclusão
• A comparação com outros oito algoritmos de aprendizado de máquina mostra
que o método proposto supera os demais em termos de acurácia. mostrou
desempenho notável, com destaque para a precisão de 87% e recall de 90%
na detecção de instâncias ofensivas. A matriz de confusão exibe que cerca de
85% das instâncias não ofensivas são classificadas corretamente, enquanto
90% das instâncias ofensivas são classificadas corretamente.