0% acharam este documento útil (0 voto)
38 visualizações260 páginas

Modelos Preditivos em Machine Learning

O documento discute conceitos fundamentais de machine learning, incluindo: (1) modelos preditivos que identificam padrões ocultos nos dados para prever resultados; (2) diferentes tipos de problemas como classificação e regressão; (3) diferentes métodos de machine learning como aprendizagem supervisionada e não supervisionada.

Enviado por

Victor Laune
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd
0% acharam este documento útil (0 voto)
38 visualizações260 páginas

Modelos Preditivos em Machine Learning

O documento discute conceitos fundamentais de machine learning, incluindo: (1) modelos preditivos que identificam padrões ocultos nos dados para prever resultados; (2) diferentes tipos de problemas como classificação e regressão; (3) diferentes métodos de machine learning como aprendizagem supervisionada e não supervisionada.

Enviado por

Victor Laune
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd

Machine Learning

Machine Learning
Machine Learning

Seja bem-vindo!
Machine Learning

Algoritmos de Machine Learning e


Modelos Preditivos
Machine Learning

Valor = Dados + Análise


Machine Learning

• Quantos clientes perdemos nos últimos 3 meses?


Modelos
Descritivos • As fraudes aumentaram ou diminuíram no último ano?
Machine Learning

Análise
Preditiva
Machine Learning

Modelo Preditivo é uma função matemática que,


aplicada a uma massa de dados, consegue identificar
padrões ocultos e prever o que poderá ocorrer
Machine Learning

Aprendizagem Aprendizagem Não


Supervisionada Supervisionada

Métodos Métodos Métodos


Métodos
Baseados em Baseados em Baseados em
Probabilísticos
Instância Procura Otimização
Machine Learning

A construção de bons modelos preditivos


implica o domínio de um conjunto de
metodologias e conceitos sem os quais a
sua qualidade poderá ser afetada
Machine Learning
Machine Learning
Machine Learning

Exemplo de Utilização de Modelos Preditivos


Machine Learning

Suponhamos uma operadora de


telefonia móvel. Um dos seus
principais problemas de empresas
deste segmento é a taxa de
desconexão ou churn rate
Machine Learning

Agregando ao modelo regras de


negócio, como agrupar clientes por
rentabilidade, a operadora pode
fazer ofertas diferenciadas para
evitar a desconexão.
Machine Learning

Dados em Volume
Dados Válidos
Adequado
Machine Learning

A escolha do modelo é importante


e diversas variáveis devem ser
consideradas
Machine Learning

Criar iniciativas de Big Data


Analytics, não é simplesmente
adquirir tecnologias
Machine Learning

Identifique com a maior precisão possível o problema de


negócio. Quanto mais precisa a pergunta, mais precisa
será a resposta e portanto maior o valor da resposta.
Machine Learning

Não superestime o valor da predição. Mesmo em uma sociedade


cada vez mais data-driven, a intuição muitas vezes é necessária.
Machine Learning

Tenha dados em volume e qualidade adequados. Sem qualidade, o


volume não tem valor.
Machine Learning

Não subestime o desafio da implementação. Não basta ter apenas a


tecnologia, é necessário expertise (conhecimento do negócio,
tecnologia, modelagem) para fazer a coisa acontecer.
Machine Learning
Machine Learning

O que é um Modelo Preditivo?


Machine Learning

Modelo Preditivo é uma função matemática que,


aplicada a uma massa de dados, consegue identificar
padrões ocultos e prever o que poderá ocorrer
Machine Learning

Modelo Preditivo
Machine Learning

f = função desconhecida

= = aproximação da função desconhecida


Machine Learning

Classificação
Machine Learning

Mas o que é um processo estocástico?


Machine Learning

Classificação Variáveis Preditoras

Espécie Tamanho (Petal) Largura (Petal) Tamanho (Sepal) Largura (Sepal)

Setosa 5.1 3.5 1.4 0.2

Setosa 4.9 3.0 1.4 0.2

Versicolor 7.0 3.2 4.7 1.4

Versicolor 6.4 3.2 4.5 1.5

Virgínica 6.3 3.3 6.0 2.5

Virgínica 5.8 2.7 5.1 1.9

Classe
Machine Learning

O objetivo do aprendizado de máquina é aprender a aproximação


da função f que melhor representa a relação entre os atributos de
entrada (chamadas variáveis preditoras) com a variável target
Machine Learning

Regressão
Machine Learning

Regressão

Mortalidade Fertilidade Agricultura Educação Renda

21.2 70.2 17.2 13 9.2

24.2 86.1 44.3 9 81.3

23.2 91.5 34.9 4 98.7

21.3 87.2 34.2 8 36.1

23.6 78.9 42.9 14 6.8


Machine Learning

Aproximação da função f Função f (desconhecida)

Custo = 1 (previsão incorreta)

Classificação Regressão Custo = Erro quadrático médio


Custo = 0 (previsão correta)
Machine Learning

Modelos Generativos Modelos Discriminativos

• Naive Bayes • Árvores de Decisão


• Redes Neurais
• KNN
Machine Learning

Métodos Baseados em Instância

Métodos Probabilísticos

Métodos Baseados em Procura

Métodos Baseados em Otimização


Machine Learning

Métodos Baseados em Instâncias


(Instance Based)
Machine Learning

Métodos de Aprendizagem
Baseado em Instâncias
Machine Learning

A aprendizagem consiste
somente em armazenar os
exemplos de treinamento
Machine Learning

O conceito base por trás deste


método é que os dados tendem a
estar concentrados em uma mesma
região no espaço de entrada
Machine Learning

Onde é o valor do p-ésimo atributo da instância x


Machine Learning

Métodos de aprendizagem baseados em instâncias


assumem que as instâncias podem ser representadas
como pontos em um espaço Euclidiano
Machine Learning

Outras Medidas de Distância

• Correlação de Pearson – Coeficiente de correlação usado em


estatística. Muito usado em bioinformática.

• Similaridade de Cosseno – Cosseno do ângulo entre os vetores.


Usado para classificação de textos e outros dados de alta dimensão.

• Distância de edição – Usado para medir distância entre strings.


Usado em classificação de textos e bioinformática.
Machine Learning

Dataset de Treino Dataset de Teste

(x1, c1) (xz, ?)


(x2, c2)
(x3, c3)
.
.
.
(xn, cn)

Variável Variável
Preditora Target
Machine Learning

Dataset de Treino Dataset de Teste

d1
(x1, c1) (xz, ?)
d2
(x2, c2) d3
(x3, c3)
.
.
dn
.
(xn, cn) Qual a similaridade entre x1 e xz?
Distância Euclidiana
Variável Variável
Preditora Target
Machine Learning

Dataset de Treino Dataset de Teste

d1
(x1, c1) (xz, c2)
d2
(x2, c2) d3
(x3, c3)
.
.
dn
.
(xn, cn) Qual a similaridade entre x1 e xz?
Distância Euclidiana
Variável Variável
Preditora Target
Machine Learning

Métodos Baseados em Instância

Constroem aproximações da função alvo para cada


instância de teste diferente.
Machine Learning

Métodos Baseados em Instância

Podem utilizar representações mais complexas e


simbólicas para as instâncias
Machine Learning

Métodos Baseados em Instância

Os métodos de aprendizagem baseados em instâncias


são métodos não paramétricos.
Machine Learning

Métodos Baseados em Instância

Uma desvantagem é o alto custo para classificação. Toda


computação ocorre no momento da classificação.
Machine Learning

Outras Características:

• Ao contrário das outras abordagens, não ocorre a construção de um modelo de


classificação explícito.
• Novos exemplos são classificados com base na comparação direta e similaridade aos
exemplos de treinamento.
• Treinamento pode ser fácil, apenas memoriza exemplos.
• Teste pode ser caro pois requer comparação com todos os exemplos de treinamento.
• Métodos baseados em instância favorecem a similaridade global e não a simplicidade
do conceito.
Machine Learning

KNN
K – Nearest Neighbours

Objetos relacionados ao mesmo conceito são


semelhantes entre si
Machine Learning

Regra do KNN

Classificar xz atribuindo a ele o rótulo representado mais


frequentemente dentre as k amostras mais próximas e utilizando
um esquema de votação.
Machine Learning

KNN
K – Nearest Neighbours
(Lazy)

K = 1  1-NN = seleciona apenas o primeiro elemento mais próximo


K = 5  5-NN = seleciona os 5 elementos mais próximos
Machine Learning

Função que Calcula a Distância


Regra de Classificação
entre as duas Instâncias
Machine Learning
Machine Learning

Métodos Probabilísticos
Machine Learning

Métodos Probabilísticos
Machine Learning

Os métodos probabilísticos bayesianos assumem que a


probabilidade de um evento A, que pode ser uma classe, dado em
um evento B, poder o conjunto de valores dos atributos de entrada,
não depender apenas da relação entre A e B, mas também da
probabilidade de observar A independentemente de B
Machine Learning

Métodos Probabilísticos
Machine Learning

Os Métodos Probabilísticos são relevantes por dois motivos:

1. Fornecem algoritmos de aprendizagem práticos:

• Aprendizagem Naïve Bayes


• Aprendizagem de Redes Bayesianas
• Combinam conhecimento a priori com os dados observados
Machine Learning

Os Métodos Probabilísticos são relevantes por dois motivos:

2. Fornecem uma estrutura conceitual útil:

Fornece a “norma de ouro” (regra do menor erro possível) para


avaliar outros algoritmos de aprendizagem.
Machine Learning

Cada exemplo de treinamento pode decrementar ou


incrementar a probabilidade de uma hipótese ser correta
Machine Learning

Conhecimento a priori pode ser combinado com os dados


observados para determinar a probabilidade de uma hipótese.
Machine Learning

Métodos Bayesianos podem acomodar hipóteses que fazem


predições probabilísticas
(Ex: Este paciente tem uma chance de 93% de se recuperar)
Machine Learning

Novas instâncias podem ser classificadas combinando a probabilidade


de múltiplas hipóteses ponderadas pelas suas probabilidades.
Machine Learning
Machine Learning

P(Doença = presente) = 0.08


P(Doença = ausente) = 0.92

P(Teste = positivo | Doença = presente) = 0.75


P(Teste = negativo| Doença = ausente) = 0.96
Machine Learning

P(Doença = presente) = 0.08


P(Doença = ausente) = 0.92

P(Teste = positivo | Doença = presente) = 0.75


P(Teste = negativo| Doença = ausente) = 0.96
Machine Learning

Confusion Matrix
Machine Learning

P(Doença = presente) = 0.08


P(Doença = ausente) = 0.92

P(Teste = positivo | Doença = presente) = 0.75


P(Teste = negativo| Doença = ausente) = 0.96

P(A) = P(A|B) x P(B)


Machine Learning

P(Teste = positivo) =

= P(Teste = positivo) | Doença = presente) x P(Doença = presente)


+ P(Teste = positivo | Doença = ausente) x P(Doença = ausente)
= 0.75 x 0.08 x 0.04 x 0.92 = 0.0968

P(Teste = negativo) =

= P(Teste = negativo) | Doença = presente) x P(Doença = presente)


+ P(Teste = negativo | Doença = ausente) x P(Doença = ausente)
= 0.25 x 0.08 x 0.96 x 0.92 = 0.9032
Machine Learning

Naive Bayes
Machine Learning

Naive Bayes
Machine Learning

O classificador Naïve Bayes é baseado na suposição simplificadora de que os


valores dos atributos são condicionalmente independentes dado o valor alvo.
Machine Learning

É possível obter classificadores


bayesianos de complexidade
crescente, que consideram diferentes
graus de dependências entre atributos
Machine Learning

Métodos Baseados em Procura


Machine Learning

Árvores de Decisão
Machine Learning

Árvores de Decisão
Machine Learning

Árvores de Decisão
Machine Learning

Árvores de decisão também podem


ser representadas como conjuntos de
regras SE–ENTÃO (IF–THEN)
Machine Learning

Árvores de decisão classificam


instâncias ordenando as árvores
acima (ou abaixo), a partir da
raiz até alguma folha
Machine Learning

ID3 (Quinlan, 1986) C4.5 (Quinlan, 1993)


Machine Learning

Entropia
Machine Learning

A Física usa o termo entropia para


descrever a quantidade de
desordem associada a um sistema
Machine Learning

A incerteza ou impureza em um nó
pode ser medida através da
Entropia

Se todos os exemplos são da


mesma classe, então a entropia
assume valor mínimo

Se todos as classes têm o mesmo


número de exemplos então a
entropia assume o valor máximo
Machine Learning

O algoritmo ID3 segue os


seguintes passos:
Machine Learning
Machine Learning
Machine Learning

Ganho de Informação
Machine Learning

Entropia mede o nível de certeza que temos sobre um evento


Machine Learning

Entropia mede o nível de certeza que temos sobre um evento

Ganho de Informação mede a efetividade de um atributo em


classificar um conjunto de treinamento
Machine Learning

Temperaturas

Normal, Baixa e Alta


Machine Learning

Métodos Baseados em Otimização


Machine Learning

SVM
Redes Neurais Artificiais
(Support Vector Machines)
Machine Learning

Redes Neurais Artificiais


Machine Learning

Redes Neurais Artificiais


RNA’s
Machine Learning
Machine Learning
Machine Learning
Machine Learning

Fórmula do Neurônio Artificial proposto por McCulloch e Pitts em 1943.


Machine Learning
Machine Learning

Deep
Learning
Machine Learning
Machine Learning
Machine Learning
Machine Learning
Machine Learning

Processos de Aprendizado
das Redes Neurais
Machine Learning

Processos de Aprendizado
das Redes Neurais

• Aprendizado Supervisionado, quando é utilizado um agente externo que indica à


rede a resposta desejada para o padrão de entrada;

• Aprendizado Não Supervisionado (auto-organização), quando não existe uma


agente externo indicando a resposta desejada para os padrões de entrada;

• Aprendizado Por Reforço, quando um crítico externo avalia a resposta fornecida


pela rede.
Machine Learning

Processos de Aprendizado
das Redes Neurais
Machine Learning

Principais Modelos de
Redes Neurais
Machine Learning

Perceptron
Machine Learning

Perceptron de Múltiplas Camadas


Machine Learning

Redes Neurais Convulocionais


(CNN – Convolutional Neural Networks)
Machine Learning

Redes Neurais Recorrentes


(RNN – Recurrent Neural Networks)
Machine Learning

Rede de Kohonen
Machine Learning

Rede de Hopfield
Machine Learning

Máquinas de Vetores de Suporte


Machine Learning

Máquina de Vetores de Suporte


Machine Learning

Máquina de Vetores de Suporte


Machine Learning

Support Vector
Machine
Machine Learning

Vetores de suporte são simplesmente as coordenadas de


observação individual.

Support Vector Machine é uma fronteira (hiperplano ) que


melhor segrega as duas classes
Machine Learning

A SVM é uma técnica de aprendizado estatístico, baseada no


princípio da Minimização do Risco Estrutural (SRM) e pode ser
usada para resolver problemas de classificação
Machine Learning

As máquinas de vetores de
suporte são consideradas uma
outra categoria das redes
neurais
Machine Learning

O uso de SVM’s é capaz de resolver problemas de classificação de


dados, gerando classificadores que apresentam bons resultados. Porém,
esses classificadores possuem uma limitação de interpretabilidade, não
sendo possível compreender a saída obtida
Machine Learning

Modelo SVM
Machine Learning

Modelo SVM
Machine Learning

Modelo SVM com 2 Dimensões


Machine Learning

Modelo SVM com 2 Dimensões


Machine Learning

Modelo SVM com Múltiplas Dimensões


Machine Learning

Boa capacidade de
generalização

Principais Características das


SVM’s
Robustez em grandes
dimensões

Convexidade da função objetivo


Machine Learning

Teoria bem definida


Machine Learning

Outras características:

Em caso de outlier a SVM busca a melhor forma possível de


classificação e, se necessário, desconsidera o outlier.

É um classificador criado para fornecer separação linear.


Outras Características das
Funciona muito bem em domínios complicados, em que SVM’s
existe uma clara margem de separação.

Não funciona bem em conjuntos de dados muito grandes,


pois o tempo de treinamento é muito custoso.

Não funciona bem em conjunto de dados com grande


quantidade de ruídos.
Machine Learning

Por que a máquina de vetores


de suporte é tão útil?
Machine Learning

Clusterização
Machine Learning
Machine Learning

C2 C3
C1
Clustering

X = {X1, X2, ..., Xn}


C = {C1, C2, ..., Ck}
Machine Learning

Clustering
Machine Learning

Medidas de Distância

Distância euclidiana: considera a distância entre dois


elementos Xi e Xj no espaço p-dimensional:

Distância “city-block”: corresponde à soma das


diferenças entre todos os p atributos de dois
elementos Xi e Xj, não sendo indicada para os casos
em que existe uma correlação entre tais atributos:
Machine Learning

Clustering
Machine Learning

Agrupamento (Clustering) é a tarefa de dividir a população ou pontos de


dados em um número de grupos de tal forma que os pontos de dados nos
mesmos grupos são mais semelhantes a outros pontos de dados no mesmo
grupo do que aqueles em outros grupos. Em palavras simples, o objetivo é
segregar grupos com traços semelhantes e atribuí-los em clusters.
Machine Learning

Agrupar todos os clientes de sua


locadora de automóveis em 10 grupos
com base em seus hábitos de compra e
usar uma estratégia separada para os
clientes em cada um desses 10 grupos.
Isso é Clusterização.
Machine Learning

Tipos de Clustering

Hard Clustering Soft Clustering


Machine Learning

Tipos de Algoritmos de Clustering


Machine Learning

Modelos de Conectividade

Modelos Centroide
Tipos de Algoritmos
de Clustering

Clustering Modelos de Distribuição

Modelos de Densidade
Machine Learning

Métodos Utilizados para


Clusterização

As heurísticas existentes para a solução de problemas de clusterização


podem ser classificadas, de forma geral, em métodos hierárquicos e
métodos de particionamento
Machine Learning

K-Means Clustering
Machine Learning

Hierarchical Clustering
Machine Learning

Hierarchical Clustering
Machine Learning

Métodos Ensemble
Machine Learning

Peso 1

Peso 2

Peso 3
Machine Learning

Métodos Ensemble
Machine Learning

As duas respostas possíveis são:

• Cliente cancela
• Cliente não cancela
Machine Learning
Machine Learning

Resultado Final
Machine Learning

Isso é Método Ensemble


Unimos as saídas de diferentes modelos para
encontrar a melhor resposta do problema
Machine Learning

Datasets Original

Passo 1 – Criação de Múltiplos Datasets

Passo 2 – Criação de Múltiplos Modelos

Passo 3 – Combinação dos Múltiplos Modelos


Machine Learning

Ensemble Baseado em
Estatísticas Simples
Modelos
Machine Learning

Ensemble pode ser aplicado por você mesmo,


para combinar seus próprios modelos
Machine Learning

Os algoritmos seguem duas abordagens principais para criar seu próprio ensemble

02
Heading
Bootstrap Aggregation ou Text
Lorem ipsum dolor Boosting
Bagging sit aconsectetuer
adipiscing

69% 75%
• Bagged CART • C5.0
• Random Forest • Stochastic Gradient Boosting
• AdaBoost
Machine Learning

Métodos Ensemble – Parte II


Machine Learning

Combinação de Preditores
Machine Learning

Bootstrap Aggregating
Boosting Voting
(Bagging)
Machine Learning

Para construção de múltiplos modelos (normalmente


Bootstrap Aggregating
do mesmo tipo) a partir de diferentes subsets no
(Bagging)
dataset de treino.
Machine Learning

Para construção de múltiplos modelos (normalmente


do mesmo tipo), onde cada modelo aprende a corrigir
Boosting
os erros gerados pelo modelo anterior, dentro da
sequência de modelos criados.
Machine Learning

Para construção de múltiplos modelos (normalmente


Voting de tipos diferentes) e estatísticas simples (como a
média) são usadas para combinar as previsões.
Machine Learning

Bootstrap Aggregating (Bagging)


Machine Learning

Bootstrap Aggregating (Bagging)

Bootstraps (amostras
diferentes da base de
dados que são usadas para
aprender hipóteses
diferentes)
Machine Learning

Bootstrap Aggregating (Bagging)


Machine Learning

Boosting

• AdaBoost (Adaptive Boosting)


• Gradient Boosting
• XGBoost

O termo "Boosting" refere-se a uma família de algoritmos que


converte modelos fracos em um modelo forte
Machine Learning

Boosting
Machine Learning

Boosting

• AdaBoost.M1
• AdaBoost.M2
• AdaBoost.R
• Adaboost.R2
• [Link]
• Boosting Correlation
Improvement (BCI)
Machine Learning

Adaboost
Machine Learning

Adaboost

Entrada: (x1, y1), ..., (xm, ym)

x = vetor de características
y = {-1, +1}
Machine Learning

Boosting para Problemas de Regressão – AdaBoost.R

f(x)
g(x)

f(xi) = g(xi), ∀xi ∈ X


Machine Learning

Gradient Boosting = Gradient Descent + Boosting


GBM = Gradient Boosting Method
Machine Learning

Gradient Boosting = Gradient Descent + Boosting


GBM = Gradient Boosting Method

Função de Perda:
y = ax + b + e
Machine Learning

XGBoost – eXtreme Gradient Boosting


Machine Learning

Por que utilizar Métodos Ensemble?


Machine Learning

Por que utilizar Métodos Ensemble?

Razões Estatísticas

Grandes volumes de dados

Pequenos volumes de dados


Machine Learning

Por que utilizar Métodos Ensemble?

Razões Estatísticas Dividir e Conquistar

Grandes volumes de dados Seleção de modelo

Pequenos volumes de dados Diversidade


Machine Learning

Redução de Dimensionalidade
Machine Learning
Machine Learning

E esse aumento no volume de


dados não é apenas em volume e
de forma vertical, mas ocorre
também na horizontal, com o
aumento do número de dimensões
ou atributos das bases de dados
Machine Learning

O termo dimensionalidade é atribuído ao número de


características de uma representação de padrões, ou seja,
a dimensão do espaço de características
Machine Learning

Extração de Atributos

Seleção de Atributos
Machine Learning

Extração de Atributos

Seleção de Atributos
Machine Learning

Principal Component Analysis, Multidimensional


Extração de Atributos Scaling e o FastMap.

Algoritmos de aprendizado de máquina, cálculo de


Seleção de Atributos dimensão fractal e wrapper.
Machine Learning

7 Técnicas para Redução da Dimensionalidade

Missing Values Ratio Low Variance Filter High Correlation Filter

Random Forests / Forward Feature Backward Feature


Ensemble Trees Construction Elimination

Principal Component
Analysis (PCA)
Machine Learning

Principal Component Analysis (PCA)


Machine Learning
Machine Learning

Cada componente resultante é uma


combinação linear de n atributos.

Cada componente
principal é uma
combinação de
atributos presentes no
dataset
Machine Learning

O PCA precisa ser alimentado com


dados normalizados. Utilizar o PCA
em dados não normalizados pode
gerar resultados inesperados.
Machine Learning

Esta técnica pode ser utilizada


para geração de índices e
agrupamento de indivíduos
Machine Learning

A análise de componentes principais é associada à ideia


de redução de massa de dados, com menor perda
possível da informação.
Machine Learning

Em termos gerais a PCA busca


reduzir o número de dimensões de
um dataset, projetando os dados em
um novo plano.
Machine Learning

Modelos Lógicos, Geométricos e


Probabilísticos
Machine Learning

Lógicos Geométricos Probabilísticos


Machine Learning

Lógicos
Machine Learning

Geométricos
Machine Learning

Probabilísticos
Machine Learning
Machine Learning

Deep Learning
Machine Learning
Machine Learning
Machine Learning
Machine Learning

CNN
Convolutional Neural
Networks
Machine Learning

O nome ”Rede Neural


Convolucional" indica que a rede
aplica uma operação matemática
denominada convolução.

Convolução é um tipo especializado


de operação linear.

Redes convolucionais são redes


neurais simples que utilizam
convolução no lugar de
multiplicação geral de matrizes em
pelo menos uma das camadas.
Machine Learning

RNN
Recurrent Neural
Networks
Machine Learning
Machine Learning

Deep Learning é a
técnica de
aprendizado baseada
em Multi-Camadas
(Redes Neurais
Densas)
Machine Learning

Reconhecimento de Voz e
Processamento de Linguagem Natural
Machine Learning
Machine Learning
Machine Learning

Muitos modelos probabilísticos são difíceis de treinar devido a


dificuldade de realizar inferência
Machine Learning
Machine Learning

Deep Learning está revolucionando a indústria aeroespacial


Machine Learning

Simulação e Otimização
Machine Learning
Machine Learning

Podemos entender a simulação


como um processo amplo que
engloba não apenas a construção
do modelo, mas todo o método
experimental que se segue
Machine Learning

Simulação implica na modelagem de um processo ou sistema, de


tal forma que o modelo imite as respostas do sistema real em uma
sucessão de eventos que ocorrem ao longo do tempo
Machine Learning

• Um dispositivo para compreensão de um problema;


• Um meio de comunicação para descrever a operação
de um sistema;
• Uma ferramenta de análise para determinar elementos
críticos e estimar medidas de desempenho;
• Uma ferramenta de projeto para avaliar problemas e
propor soluções;
• Um sistema de planejamento de operações para
trabalhos, tarefas e recursos;
• Um mecanismo de controle;
• Uma ferramenta de treinamento;
• Uma parte do sistema para fornecer informações on-
line, projeções de situações e suporte à decisão.
Machine Learning
Machine Learning

Variáveis
Machine Learning

Variáveis de
Estado
Machine Learning

Entidade
Machine Learning

Atributo
Machine Learning

Recurso
Machine Learning

Processos
Machine Learning

Tempo de
Simulação
Machine Learning

Filas
Machine Learning

Eventos
Machine Learning

A simulação é a técnica
empregada durante a fase de
construção do modelo preditivo
Machine Learning

Pode ser necessário a simulação


de uma grande variedade de
alternativas e a criação de
modelos preditivos pode gerar
bons resultados
Machine Learning

Machine Learning nos ajuda a simular um


determinado evento através de dados e com isso,
prever o comportamento futuro.
Machine Learning

Modelos Determinísticos
x
Modelos Estocásticos
Machine Learning

Modelos Determinísticos
Machine Learning

Modelos Estocásticos
Machine Learning

Quando uma variável de entrada de um sistema é aleatória, a


variável de saída também será aleatória, no entanto, o sistema pode
ter comportamento determinístico ou ser representado por um
modelo determinístico
Machine Learning
Machine Learning

Modelo Computacional é um programa de


computador cujas variáveis apresentam o mesmo
comportamento dinâmico e estocástico do
sistema real que representa

Variáveis de Variáveis de
Entrada Modelo Saída
Machine Learning

Velocidades Comportamentos
individuais
observadas em
Modelo Normais ou Anormais
e Tendências
uma avenida
Machine Learning

Determinístico Estocástico

Resultado do modelo é pré- Resultado do modelo não


determinado em função dos depende somente dos dados
dados de entrada de entrada, mas também de
outros fatores, normalmente
aleatórios. Isso requer um
modelo probabilístico.
Machine Learning

Determinístico Estocástico

Exemplo: Se uma pessoa tem Exemplo: Modelo para prever a


mais de 16 anos, ela pode tirar reação de pessoas em um
carteira de motorista. Se tiver shopping, a uma situação de
menos de 16, não pode. emergência. Um modelo
probabilístico tenta descrever o
comportamento ”aleatório” das
entidades
Machine Learning

Modelos determinísticos e estocásticos podem ser combinados para resolver


problemas que requerem muitas alternativas diferentes, tais como:

• Busca na Web e Extração de Informação


• Desenvolvimento de Novos Medicamentos
• Prever o Comportamento do Mercado Financeiro
• Compreender o Comportamento de Clientes
• Criação de Robôs
Machine Learning
Machine Learning

Otimização
Machine Learning
Machine Learning

Otimização
Machine Learning

Aprendizado = Representação + Avaliação + Otimização


Machine Learning

Aprendizado =

Representação + Avaliação + Otimização


Machine Learning

Ao contrário da simulação onde existe incerteza associada com os


dados de entrada, na otimização nós temos não somente acesso aos
dados, mas também as informações de dependências e
relacionamentos entre os atributos dos dados.
Machine Learning

Generalização  Principal Objetivo na Construção do Modelo Preditivo


Machine Learning

Seleção de Modelo
Machine Learning

Definir
Definir Espaço de
Configurações de
Parâmetro
Validação Cruzada

Treinar, Avaliar e
Definir Métrica
Comparar
Machine Learning

Gradiente Descendente
(Gradient Descent)
Machine Learning

Gradiente Descendente
(Gradient Descent)
Machine Learning

Gradiente Descendente
(Gradient Descent)
Machine Learning

Gradiente Descendente
(Gradient Descent)

coefficient = 0.0
cost = f(coefficient)
delta = derivative(cost)
coefficient = coefficient – (alpha * delta)
Machine Learning

Gradiente Descendente
(Gradient Descent)

Batch Gradient Descent Stochastic Gradient Descent


Machine Learning

Obrigado

Você também pode gostar