0% encontró este documento útil (0 votos)
3 vistas48 páginas

S10 ModelosdeMachineLearningforDataScience

El documento presenta un curso sobre Machine Learning dentro del Diploma de Alta Especialización en Big Data y Data Science, abordando conceptos de aprendizaje supervisado y no supervisado, así como diferentes algoritmos y técnicas. Se discuten las aplicaciones prácticas de Machine Learning, su clasificación y el uso de árboles de decisión. Además, se enfatiza la importancia de la preparación y visualización de datos en el proceso de aprendizaje automático.

Cargado por

Ehjf Shhf
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
3 vistas48 páginas

S10 ModelosdeMachineLearningforDataScience

El documento presenta un curso sobre Machine Learning dentro del Diploma de Alta Especialización en Big Data y Data Science, abordando conceptos de aprendizaje supervisado y no supervisado, así como diferentes algoritmos y técnicas. Se discuten las aplicaciones prácticas de Machine Learning, su clasificación y el uso de árboles de decisión. Además, se enfatiza la importancia de la preparación y visualización de datos en el proceso de aprendizaje automático.

Cargado por

Ehjf Shhf
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

“Diploma de Alta Especialización en Big Data y Data Science”

Modelos de Machine Learning for Data Science


Ing. Jorge Rodríguez
Agenda

• Machine Learning

• Aprendizaje Supervisado - Conceptos

• Aprendizaje No Supervisado - Conceptos

• Árboles de regresión y bosques aleatorios.

• Practica
Objetivos

• Aprender a preparar datos y visualizarlos


• Entender diferentes algoritmos de Machine Learning
• Distinguir algoritmos Supervisados vs No Supervisados
Machine Learning - Concepto

“El aprendizaje automático es un subdominio de la IA que


proporciona a los sistemas la capacidad de aprender y mejorar
automáticamente
Machine Learning - Concepto

Esa la ciencia de usar algoritmos para identificar patrones en


datos con el fin de resolver un problema de interés.
Machine Learning - Historia
Inductivo

Uso de observaciones específicas para


formar una conclusión general

Deductivo

Uso de una premisa general para llegar a una


conclusión
Machine Learning es usado actualmente
en la vida de todo el mundo

Emails de spams cuestan a empresas cerca de $21 mil millones de dólares en 2021
“ En 2015 Google dijo que puede
identificar el 99.9% de emails de spams.”
Machine Learning
Machine Learning – Estado del Arte
IA– Oportunidades
Machine Learning – Resumen 1
Machine Learning – Clasificación
• En función de la manera en la que se
entrenan:
➢ Aprendizaje supervisado
➢ Aprendizaje no supervisado
➢ Aprendizaje semi-supervisado
➢ Aprendizaje reforzado

• En función de la manera en la que aprenden


en el tiempo
➢ Aprendizaje online
➢ Aprendizaje en batch

• En función de la forma en la que realizan


predicciones:
➢ Aprendizaje basado en instancias
➢ Aprendizaje basado en modelos
Machine Learning – Clasificación
• En función de la manera en la que se
entrenan:
➢ Aprendizaje supervisado
➢ Aprendizaje no supervisado
➢ Aprendizaje semi-supervisado
➢ Aprendizaje reforzado

• En función de la manera en la que aprenden


en el tiempo
➢ Aprendizaje online
➢ Aprendizaje en batch

• En función de la forma en la que realizan


predicciones:
➢ Aprendizaje basado en instancias
➢ Aprendizaje basado en modelos
Machine Learning – Clasificación
• En función de la manera en la que se
entrenan:
➢ Aprendizaje supervisado
➢ Aprendizaje no supervisado
➢ Aprendizaje semi-supervisado
➢ Aprendizaje reforzado

• En función de la manera en la que aprenden


en el tiempo
➢ Aprendizaje online
➢ Aprendizaje en batch

• En función de la forma en la que realizan


predicciones:
➢ Aprendizaje basado en instancias
➢ Aprendizaje basado en modelos
Machine Learning – según forma de entrenar

Por ejemplo :
• Clustering :
Target ouput (objetivo de salida • El modelo tiene caracteristicas
es numérico.
• Dimensionality Reduction de entrada y salida.
Se quiere encontrar que • Hay un target/objetivo por predecir
features de entrada en los
datos son de ayuda

Por ejemplo :
• Regresión:
Target ouput (objetivo de salida
es numérico.
• Clasificación
Target ouput es una etiqueta
(categórico)
Machine Learning – según forma de entrenar
Sistemas que aprenden sin seguir instrucciones explícitas, usan algoritmos y modelos
estadísticos para analizar y hacer inferencias de los datos.

No supervisado Supervisado Refuerzo


Machine Learning – según forma de entrenar
Resumen
Machine Learning – Aprendizaje Supervisado
• "El aprendizaje supervisado es la tarea de aprendizaje
automático que consiste en aprender una función que
mapea una entrada a una salida basada en pares de
entrada-salida de ejemplo"

• La funcion resultante es utilizada posteriormente para


predecir valores a partir de ejemplos de datos no
etiquetados.
Menhryar Mohri,Afshin Rostamizadeh,Ameet Talwalkar(2012)foundations of machine learning, the MIT Press

Conjunto de Algoritmo de
datos de aprendizaje (función h
entrenamiento de hipótesis)

y(predicción)
Machine Learning – Aprendizaje No Supervisado
El aprendizaje no supervisado es la tarea de aprendizaje automático
que consiste en inferir una función que describe la estructura de un
conjunto de datos sin etiquetar (es decir, datos que no se han
clasificado ni categorizado)

xx
x x
Conjunto de x
Algoritmo de x xx
datos de sin
aprendizaje h x x
etiquetar

y(descripción)
Machine Learning – Resumen2
Machine Learning – según aprendizaje en el tiempo
Aprendizaje batch

Los sistemas basados en aprendizaje batch no aprenden de manera incremental y se entrenan utilizando todos
los datos disponibles.

Puesta en
Datos
producción

correcta

Entrenamiento del evaluación


Análisis del Problema
Algoritmo

incorrecta

Análisis de
errores
Machine Learning – Aprendizaje Batch
Los sistemas basados en aprendizaje batch no aprenden de manera incremental y se entrenan utilizando todos
los datos disponibles.

• Si se desea que el sistema se adapte a un nuevo tipo de dato, se debe entrenar de nuevo con todos los datos
disponibles.
• Solución sencilla.
• Funciona bien para sistemas que no requieren un conjunto grande de datos ni adaptarse a nuevos datos
de manera muy rápida.
• Restringido para dispositivos con capacidad limitada de recursos, como equipos móviles.
Machine Learning – según aprendizaje en el tiempo
Aprendizaje online
Los sistemas basados en aprendizaje online se entrenan incrementalmente mediante el consumo gradual-
incremental de datos, ya sea individuales o en pequeños grupos (mini-batches)

Ejecución y Datos en
aprendizaje tiempo real

Puesta en
Datos
producción

correcta

Entrenamiento del evaluación


Análisis del Problema
Algoritmo

incorrecta

Análisis de
errores
Machine Learning – Aprendizaje Online
Los sistemas basados en aprendizaje online se entrenan incrementalmente mediante el consumo gradual-
incremental de datos, ya sea individuales o en pequeños grupos (mini-batches)

• Solución ideal para sistemas que reciben datos continuamente y requiere adaptarse a ellos rápidamente.
• Es capaz de lidiar con grandes conjuntos de datos que puede que no entren en una sóla maquina.
• Aparecen algunas variables importantes que hay que determinar, como el ratio de aprendizaje.
• Pueden ser muy inestables si por alguna razón se consumen datos de baja calidad.
Machine Learning – según forma de predicción
Aprendizaje basado en instancias
• El Sistema aprende de los ejemplos del conjunto de datos de entrenamiento y luego intenta generalizar para
nuevos ejemplares.

• Se requiere una medida de similitud.


Machine Learning – según forma de predicción
Aprendizaje basado en modelos
• Se crea un modelo que describe el conjunto de datos y se utiliza para realizar predicciones

• Se requiere ajustar los parámetros del modelo .

Línea del modelo


Quiz
Quiz
Quiz
Quiz
Deep Learning (Aprendizaje Profundo)

Aprendizaje basado en redes neuronales


en las que se utilizan múltiples capas para
extraer características de los datos (feature
learning).

Auge en los últimos años con el avance de


la computación y la enorme cantidad de
datos. (con ventajas y desventajas)
¿Por qué el auge?

$ Costo de la predicción
La IA y analítica
avanzada nos permite
predecir de manera:

- Más rápida
- Más barata
- Mejor

1950 20XX
Escalera de Valor Analítico
Analítica
Prescriptiva

Analítica
Predictiva

Analítica
Valor

de Diagnostico

Analítica
Descriptiva

Dificultad
Machine Learning – Aprendizaje No Supervisado

El aprendizaje no supervisado es un tipo de


algoritmo que aprende patrones a partir de
datos no etiquetados. La idea es que a
través de las similitudes, que es un modo
importante de aprendizaje en las personas, la
máquina se vea obligada a construir una
representación interna y generalizar a partir
de ella.

Agrupación, Asociación, Reducción de


dimensiones
Reglas de Asociación

Se utilizan para descubrir hechos que ocurren en común dentro de un determinado


conjunto de datos. Suele utilizarse para Market-Basket Analysis, Sistemas de
recomendación, Venta cruzada.
K-Medias

Es un método de agrupamiento,
que tiene como objetivo la
partición de un conjunto de n
observaciones en k grupos en el
que cada observación pertenece al
grupo cuyo valor medio es más
cercano.
Aprendizaje Supervisado

Es la tarea de aprender una función que


asigna una entrada a una salida basada en
pares de entrada-salida de ejemplo. Infiere
una función a partir de datos de
entrenamiento etiquetados que consisten en
un conjunto de ejemplos de entrenamiento.
Arbol de Decisiones
¿Tiempo
de
Los árboles de decisión tienden contrato?
a ser el método de elección para < 6 meses >= 6 meses
el modelado predictivo porque
son relativamente fáciles de
¿Contrato? ¿Contrato?
entender y también son muy
efectivos.
Mensual Contrato Mensual Contrato
El objetivo básico de un árbol de
decisión es dividir una población
de datos en segmentos más Churn No Churn No Churn No Churn
pequeños.
Decision Tree
¿Qué sucede al predecir?

Usamos una partición de datos en


conjunto de entrenamiento, validación
y prueba. Esto con el fin de guardar un
estimador insesgado con el cual
validar nuestro modelo y conclusiones.
¿Qué sucede al predecir?
Haciendo sentido del modelo
Preguntas y Respuestas
“Diploma de Alta Especialización en Big Data y Data Science”
Modelos de Machine Learning for Data Science
Ing. Jorge Rodríguez

También podría gustarte