ESCOLA TÉCNICA ESTADUAL POLIVALENTE DE AMERICANA
CURSO: DESENVOLVIMENTO DE SISTEMAS
MACHINE LEARNING
GRUPO:
Eduardo Schafer
Maria Eduarda
Kauã Aissa
Vinícius Balbino
Vinícius Polizeli
Trabalho apresentado no
componente curricular Técnicas
de Programação e Algoritmo do
curso Técnico em
Desenvolvimento de Sistemas.
PROFESSORAS: GISLAINE F. GIUBBINA
II
Americana - SP
II
Sumário
1. Introdução...............................................................................................................2
2. Desenvolvimento - Pesquisa...................................................................................2
3. Conclusão...............................................................................................................2
4. Fontes de pesquisa..................................................................................................3
1. Introdução
Machine Learning é um ramo da inteligência artificial (IA) e da ciência da
computação que se concentra no uso de dados e algoritmos para imitar a
maneira como os humanos aprendem, melhorando gradualmente sua precisão.
Machine learning é um componente importante do crescente campo da ciência
de dados. Por meio do uso de métodos estatísticos, os algoritmos são
treinados para fazer classificações ou previsões, revelando os principais
insights em projetos de mineração de dados. Esses insights subsequentemente
3
conduzem a tomada de decisões em aplicativos e negócios, impactando de
forma ideal as principais métricas de crescimento. Conforme o big data
continua a se expandir e crescer, a demanda do mercado por cientistas de
dados aumentará, exigindo que eles auxiliem na identificação das questões de
negócios mais relevantes e, posteriormente, os dados para respondê-las.
2. Desenvolvimento - Pesquisa
O Machine Learning pode ser definido como:
Um processo de decisão: Em geral, algoritmos de Machine Learning são
usados para fazer uma predição ou classificação. Com base em alguns dados
de entrada, que podem ser rotulados ou não rotulados, seu algoritmo
produzirá uma estimativa sobre um padrão nos dados.
Uma função de erro: Uma função de erro serve para avaliar a predição do
modelo. Se houver exemplos conhecidos, uma função de erro poderá fazer
uma comparação para avaliar a precisão do modelo.
Um processo de otimização de modelo: Se o modelo pode se ajustar
melhor aos pontos de dados no conjunto de treinamento, então os pesos são
ajustados para reduzir a discrepância entre o exemplo conhecido e a
estimativa do modelo. O algoritmo repetirá este processo de avaliação e
otimização, atualizando os pesos de maneira autônoma até que um limite de
precisão seja atingido.
E existem três métodos aplicáveis no Machine Learning:
Machine learning supervisionado
Aprendizado supervisionado, também conhecido como machine learning
supervisionado, é definido pelo uso de conjuntos de dados rotulados para
treinar algoritmos que classificam dados ou preveem resultados com precisão.
Conforme os dados de entrada são alimentados no modelo, ele ajusta seus
pesos até que o modelo tenha sido ajustado de maneira adequada. Isso ocorre
como parte do processo de validação cruzada para garantir que o modelo
evita super ajuste ou sub-ajuste. O aprendizado supervisionado ajuda as
organizações a resolver uma variedade de problemas do mundo real em
grande escala, como a classificação de spam em uma pasta separada da sua
caixa de entrada. Alguns métodos usados na aprendizagem supervisionada
incluem redes neurais, naive bayes, regressão linear, regressão logística,
floresta aleatória, máquina de vetores de suporte (SVM) e muito mais.
Machine learning não supervisionado
Aprendizado não supervisionado, também conhecido como machine learning
não supervisionado, usa algoritmos de machine learning para analisar e
agrupar conjuntos de dados não rotulados. Esses algoritmos descobrem
padrões ocultos ou agrupamentos de dados sem a necessidade de intervenção
humana. Sua capacidade de descobrir semelhanças e diferenças nas
informações torna a solução ideal para análise exploratória de dados,
4
estratégias de vendas cruzadas, segmentação de clientes, imagem e
reconhecimento de padrões. Também é usado para reduzir o número de
recursos em um modelo por meio do processo de redução de
dimensionalidade, a análise de componente principal (PCA) e a decomposição
de valor singular (SVD) são duas abordagens comuns para isso. Outros
algoritmos usados no aprendizado não supervisionado incluem redes neurais,
armazenamento em cluster de k-médias, métodos de armazenamento em
cluster probabilístico e muito mais.
Aprendizado semissupervisionado
O aprendizado semissupervisionado oferece um bom meio-termo entre o
aprendizado supervisionado e o não supervisionado. Durante o treinamento,
ele usa um conjunto de dados rotulado menor para orientar a classificação e a
extração de recursos de um conjunto de dados maior e não rotulado. O
aprendizado semissupervisionado pode resolver o problema de não haver
dados rotulados suficientes (ou não ser capaz de rotular dados suficientes)
para o treinamento de um algoritmo de aprendizado supervisionado.
3. Conclusão
Não há dúvidas de que o machine learning é o futuro, especialmente na área
da saúde. Uma vez que um computador consegue detectar alterações e
padrões imperceptíveis aos olhos humanos, o machine learning vai ser (e está
sendo) muito útil na patologia para detectar doenças, formas mais ou menos
agressivas de tumores, padrões que podem predizer se determinada condição
tem chances de evoluir para câncer, enfim, uma nova era está surgindo.
4. Fontes de pesquisa
[Link]
[Link]
[Link]