Exercício — Machine Learning e Deep Learning
Turma: Engenharia da Computação • 15 questões com gabarito resumido
Objetivo Revisar conceitos centrais de aprendizado de
máquina e deep learning, relacionando
teoria, métricas e aplicações de engenharia.
Parte A — Conceitos fundamentais
1. Explique com suas palavras a diferença entre programação tradicional e machine
learning.
Programação tradicional: você escreve regras explícitas (if, else, etc.).
Machine Learning: você fornece dados e o modelo aprende padrões sozinho sem regras fixas.
2. Em um problema de classificação, o que são features, target, treino e validação?
Dê um exemplo de cada um.
Features: variáveis de entrada (ex: altura, idade)
Target: o que queremos prever (ex: aprovado/reprovado)
Treino: dados usados pra ensinar o modelo
Validação: dados usados pra testar o modelo
3. Uma base possui as colunas temperatura, vibração, pressão e falha_da_maquina.
Quais colunas podem ser usadas como entrada e qual pode ser usada como saída
em um modelo preditivo? Justifique.
Entradas: temperatura, vibração, pressão
Saída: falha_da_maquina
Porque as 3 primeiras ajudam a prever se a máquina falha.
4. Qual é a diferença entre classificação, regressão e agrupamento (clustering)? Dê
um exemplo de aplicação de engenharia para cada caso.
Classificação: saída categórica (ex: spam ou não spam)
Regressão: valor numérico (ex: prever temperatura)
Clustering: agrupar dados sem rótulo (ex: agrupar tipos de falhas)
5. Uma árvore de decisão é considerada um modelo mais interpretável do que uma
rede neural. Explique por quê.
Árvore de decisão é interpretável porque mostra decisões em forma de regras claras.
Rede neural é tipo uma caixa preta, ninguém entende direito o que ela tá pensando.
Parte B — Métricas e avaliação
6. Um modelo de classificação binária gerou a seguinte matriz de confusão:
Verdadeiros Positivos = 40, Verdadeiros Negativos = 50, Falsos Positivos = 5, Falsos
Negativos = 15. Calcule acurácia, precisão e recall.
Dados:
VP=40, VN=50, FP=5, FN=15
Acurácia = (40+50)/(40+50+5+15) = 90/110 = 0,818 (81,8%)
Precisão = 40/(40+5) = 40/45 = 0,888 (88,8%)
Recall = 40/(40+15) = 40/55 = 0,727 (72,7%)
7. Em um sistema de diagnóstico de falha crítica, o que tende a ser mais importante:
precisão ou recall? Explique o motivo.
Recall é mais importante.
Porque perder uma falha crítica (FN) é pior do que um alarme falso.
8. Um modelo teve acurácia muito alta no treino, mas desempenho fraco na
validação. O que pode estar acontecendo? Como esse problema é chamado?
Isso é overfitting.
O modelo decorou o treino e não generaliza bem.
9. Por que avaliar apenas acurácia pode ser perigoso em bases desbalanceadas?
Porque em base desbalanceada, o modelo pode acertar muito só chutando a classe
maioritária.
Parte C — Redes neurais e deep learning
10. O que caracteriza uma rede neural artificial? Explique o papel de neurônio, peso,
função de ativação e camada oculta.
Neurônio: unidade básica que recebe entradas
Peso: importância de cada entrada
Função de ativação: decide saída do neurônio
Camada oculta: onde o modelo aprende padrões complexos
11. Qual é a principal ideia por trás do termo deep learning?
Deep Learning = redes neurais com muitas camadas, capazes de aprender padrões muito
complexos.
12. Explique, de forma intuitiva, o que acontece nas etapas: forward pass, cálculo da
loss, backpropagation e gradient descent.
Forward pass: dados passam pela rede
Loss: mede o erro
Backpropagation: calcula como corrigir
Gradient descent: ajusta os pesos pra reduzir erro
13. Em muitos casos, a normalização dos dados ajuda no treinamento de redes
neurais. Por quê?
Normalização ajuda porque evita valores muito grandes/pequenos, deixando o treino mais
estável e rápido.
Parte D — Aplicações e raciocínio de engenharia
14. Considere dois cenários: A) prever se um aluno será aprovado ou reprovado com
base em frequência, horas de estudo e notas parciais; B) reconhecer defeitos visuais
em peças industriais a partir de imagens. Que tipo de modelo parece mais adequado
em cada cenário? Justifique.
A) Classificação com modelo simples (tipo árvore ou regressão logística)
B) Rede neural convolucional (CNN), porque trabalha com imagem
15. Compare, de forma resumida, árvore de decisão e rede neural, considerando
interpretabilidade, custo computacional, complexidade dos padrões aprendidos e
adequação para sala de aula.
CONDIÇÃO ARVORE DE DECISÃO REDE NEURAL
INTERPRETABILIDADE ALTA BAIXA
CUSTO COMPUTACIONAL BAIXO ALTO
COMPLEXIBILIDADE BAIXA ALTA
SALA DE AULA MELHOR MAIS DIFICIL
Questão bônus
Bônus. Você foi contratado para desenvolver um sistema que detecta risco de falha
em equipamentos industriais. Descreva: quais dados você coletaria, qual seria o
target, que tipo de modelo testaria primeiro e como avaliaria se ele está funcionando
bem.
Dados: temperatura, vibração, pressão, histórico de falhas
Target: falha (sim/não)
Modelo inicial: árvore de decisão ou random forest
Avaliação: recall, precisão e matriz de confusão