0% acharam este documento útil (0 voto)
2 visualizações3 páginas

CNNs e RNNs

O documento aborda as arquiteturas de redes neurais profundas, destacando as Redes Neurais Convolucionais (CNNs) e as Redes Neurais Recorrentes (RNNs). As CNNs são eficazes para dados espaciais, como imagens, enquanto as RNNs são adequadas para dados sequenciais, como linguagem natural. Variações como LSTM e GRU foram desenvolvidas para melhorar o desempenho das RNNs em aprender dependências de longo prazo.

Enviado por

gerson
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd
0% acharam este documento útil (0 voto)
2 visualizações3 páginas

CNNs e RNNs

O documento aborda as arquiteturas de redes neurais profundas, destacando as Redes Neurais Convolucionais (CNNs) e as Redes Neurais Recorrentes (RNNs). As CNNs são eficazes para dados espaciais, como imagens, enquanto as RNNs são adequadas para dados sequenciais, como linguagem natural. Variações como LSTM e GRU foram desenvolvidas para melhorar o desempenho das RNNs em aprender dependências de longo prazo.

Enviado por

gerson
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd

Data Science Academy [Link]@gmail.

com 5ea07d89e32fc30995063970

Deep Learning Para Aplicações de Inteligência Artificial com Python e C++

SQL Para Análise de Dados e Data Science

Deep Learning Para Aplicações de


Inteligência Artificial com Python e C++

Redes Neurais Convolucionais (CNNs) e


Redes Neurais Recorrentes (RNNs)

Data Science Academy


[Link]
Data Science Academy [Link]@[Link] 5ea07d89e32fc30995063970

Deep Learning Para Aplicações de Inteligência Artificial com Python e C++

Redes Neurais Convolucionais (CNNs) e Redes Neurais Recorrentes (RNNs) são duas
arquiteturas fundamentais de redes neurais profundas que se destacam em diferentes tipos de
tarefas de aprendizado de máquina.

As CNNs são particularmente eficazes no processamento de dados que possuem uma


grade espacial, como imagens, onde a localização relativa de características é essencial para a
realização de tarefas como classificação e detecção de objetos.

A arquitetura de uma CNN é caracterizada por camadas convolucionais que aplicam filtros
aos dados de entrada, capturando assim características locais. Estes filtros são pequenos em
termos de largura e altura, mas se estendem por toda a profundidade do volume de entrada.

Após cada camada convolucional, normalmente há uma camada de pooling, que serve
para reduzir as dimensões espaciais e agrupar características importantes. No final da CNN, há
camadas densamente conectadas que interpretam as características de alto nível extraídas pelas
camadas convolucionais e de pooling para fazer previsões ou classificações. A imagem abaixo
ilustra essa arquitetura:

A arquitetura CNN surgiu no final da década de 80, mas ganhou impulso nos anos 2000.
Técnicas modernas atuais, como os Vision Transformers, usam camadas convolucionais ou redes
convolucionais inteiras como backbone (parte central da arquitetura), como aliás veremos aqui
neste curso.

As RNNs são especialmente adequadas para dados sequenciais, como linguagem natural
ou séries temporais, onde a ordem e o contexto são importantes. A propriedade distintiva das
RNNs é a sua capacidade de manter um estado ou memória ao longo do tempo, usando suas
conexões recorrentes, onde saídas de etapas anteriores são utilizadas como entrada juntamente
com novos dados de entrada.

Isso permite que as RNNs formem uma espécie de memória sobre os elementos
anteriores na sequência, o que é crucial para a compreensão do contexto e a geração de

Data Science Academy


[Link]
Data Science Academy [Link]@[Link] 5ea07d89e32fc30995063970

Deep Learning Para Aplicações de Inteligência Artificial com Python e C++

previsões. Contudo, a arquitetura RNN padrão muitas vezes tem dificuldades para aprender
dependências de longo prazo devido a problemas como o desaparecimento ou a explosão do
gradiente.

Para superar os problemas da RNN padrão, variações como LSTM (Long Short-Term
Memory) e GRU (Gated Recurrent Units) foram desenvolvidas. Estas estruturas utilizam portões
especiais para controlar o fluxo de informações, permitindo que a rede retenha seletivamente
ou descarte informações ao longo do tempo, facilitando a aprendizagem de dependências de
longo prazo. A imagem abaixo mostra a comparação entre RNN padrão, LSTM e GRU

A arquitetura LSTM, que surgiu em 1997, foi um dos maiores avanços em Deep Learning
e a arquitetura Transformer nasceu exatamente para tentar melhorar essa arquitetura em
tarefas de PLN. E conseguiu!

Enquanto as CNNs impõem uma estrutura hierárquica local para o reconhecimento de


padrões, as RNNs abordam a sequencialidade e a temporalidade dos dados. Ambas as
arquiteturas revolucionaram campos como Visão Computacional e Processamento de Linguagem
Natural, respectivamente, e continuam a ser áreas de pesquisa intensa para melhorar a
capacidade das máquinas de aprender e interpretar dados complexos.

Data Science Academy


[Link]

Você também pode gostar