Perceptron Adaline
ESW107 - Redes Neurais
Prof. Me. Sandro Silva Moreira
[Link]@[Link]
Conceitos Iniciais
• A rede Adaline (Adaptive Linear Element) proposta por Widrow e Hoff (1960) tem a
mesma estrutura do Perceptron, diferenciando apenas no algoritmo de treinamento
Características da Adaline:
• Rede adaptativa
• Inclusão de um algoritmo pioneiro para o treinamento de redes de múltiplas
camadas, o algoritmo de treinamento da regra Delta
• O algoritmo da regra Delta é baseado no método dos mínimos quadrados
• Método de aprendizado mais suave
Conceitos Iniciais
• A rede Adaline (Adaptive Linear Element) proposta por Widrow e Hoff (1960) tem a
mesma estrutura do Perceptron, diferenciando apenas no algoritmo de treinamento
Características da Adaline:
• Rede adaptativa
• Inclusão de um algoritmo pioneiro para o treinamento de redes de múltiplas
camadas, o algoritmo de treinamento da regra Delta
• O algoritmo da regra Delta é baseado no método dos mínimos quadrados
• Método de aprendizado mais suave
Adaline
Inclusão de um bloco de sinal de erro para modificar os valores dos pesos
Regra Delta
• O algoritmo de treinamento do Adaline é baseado no método dos mínimos quadrados,
conhecido como Regra Delta
• Devido a incapacidade do algoritmo de treinamento do Perceptron em gerar pesos que
classifiquem dados não linearmente separáveis, Widrow e Hoff projetaram a regra Delta
em 1960
• O algoritmo utiliza o método do gradiente descendente com a intenção de diminuir o
valor da função de erro possibilitando assim a convergência para um mínimo da função
de erro
Regra Delta
• Objetivo: Realizar iterações locais para obter o ponto mínimo da função de erro e,
assim, fixar os valores dos pesos quando o mínimo foi encontrado
• Funcionamento: Através de um ponto arbitrário (vetor de pesos iniciado
aleatoriamente), o algoritmo percorre, a cada iteração a superfície da função de erro
em direção ao ponto de mínimo
Essa trajetória é possível quando caminhar sempre no sentido oposto ao do gradiente do
ponto atual
Demonstração da Regra Delta
Processo de Convergência do Adaline
Em notação algorítmica:
Busca pelo peso ideal com erro mínimo possível
Função do erro quadrático:
Converge quando o erro é suficientemente pequeno:
Onde ε é a taxa de precisão que se espera
Algoritmo de Treinamento da Adaline
Treinamento da Adaline
A fim de ilustrar o processo visando o alcance da fronteira da separabilidade entre classes
apresentamos abaixo duas situações que mostram sua convergência rumo a estabilização
considerando apenas duas entradas { x1 e x2 }
Comparando Perceptron e Adaline
• No Perceptron, o hiperplano que separa as classes pode ter infinitas disposições, pois a
configuração final do seu vetor é dependente dos valores iniciais aleatoriamente alocados
• Na Adaline, a inclinação do hiperplano é ajustada por intermédio do método dos mínimos
quadrados dos erros (LMS - least mean square). Independentemente dos valores iniciais atribuídos
para o vetor de pesos, a configuração final do hiperplano será a mesma.
Exemplo de Perceptron Adaline