0% encontró este documento útil (0 votos)
31 vistas19 páginas

Introducción a Machine Learning

El documento proporciona una introducción al machine learning (ML), describiendo que es una rama de la inteligencia artificial que utiliza algoritmos para analizar datos y hacer predicciones. Explica que ML incluye técnicas como regresión, clasificación, clustering y reducción de dimensionalidad. También describe la relación de ML con áreas como inteligencia artificial, aprendizaje profundo y ciencia de datos. Finalmente, resume varios algoritmos populares de ML como random forest, gradient boosting y deep learning.

Cargado por

Gaston
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
31 vistas19 páginas

Introducción a Machine Learning

El documento proporciona una introducción al machine learning (ML), describiendo que es una rama de la inteligencia artificial que utiliza algoritmos para analizar datos y hacer predicciones. Explica que ML incluye técnicas como regresión, clasificación, clustering y reducción de dimensionalidad. También describe la relación de ML con áreas como inteligencia artificial, aprendizaje profundo y ciencia de datos. Finalmente, resume varios algoritmos populares de ML como random forest, gradient boosting y deep learning.

Cargado por

Gaston
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Resumen ML

¿Qué es machine learning?


O también aprendizaje automá3co, son programas que usan algoritmos para analizar
datos y hacer predicciones basadas en datos, además es una rama de la inteligencia
ar3ficial, algunos ejemplos son los siguientes:
• Google maps
• Programa que detecta si es un perro o gato
El obje3vo es que las maquinas puedan actuar como humanos para lograr nuevos
obje3vos

Relación con otras áreas

IA: es una rama de la informá3ca que busca desarrollar algoritmos, sistemas y técnicas que
permitan a las máquinas aprender, razonar y adaptarse, imitando las habilidades
cogni3vas humanas, como el aprendizaje, la percepción, el reconocimiento de patrones y
la toma de decisiones.
Narrow AI: Machinas que se desempeñan tan bien o mejor que los humanos en tareas
específicas como detectar enfermedades del corazón basándose en imágenes, o jugar y
ganar GO a campeones mundiales. Pero esta AI es buena sólo en una tarea.
General AI: Machinas desplegando múl3ples habilidades humanas, pero en la prác3cas
estamos aún muy lejos de esto.
ML : es un subcampo de la IA que se centra en el desarrollo de algoritmos y modelos
matemá3cos que permiten a las máquinas aprender de los datos y mejorar su rendimiento
en tareas específicas. El ML u3liza técnicas estadís3cas y de op3mización para ajustar
automá3camente los modelos a medida que se alimentan con nuevos datos. No se
programan explícitamente.
Deep Learning (DL) : es sólo una de las técnicas para implementar ML, por ahora asuman
que DL es un 3po de algoritmo de ML
Data Science: es una disciplina interdisciplinaria que combina técnicas de estadís3ca &
matemá3cas, informá3ca y conocimiento del dominio para analizar, interpretar y extraer
información valiosa de grandes conjuntos de datos. La DS u3liza algoritmos y modelos de
ML para iden3ficar patrones, realizar predicciones y tomar decisiones basadas en datos.

Visión General de los algoritmos


Regresión mulElineal: El obje3vo es encontrar una ecuación matemá3ca que describa la
relación entre las variables y se puede u3lizar para hacer predicciones precisas de la
variable dependiente. Es una técnica estadís3ca poderosa y se u3liza en muchas
disciplinas. Es técnica de ml supervisado.

Que hacen los algoritmos de ML: Clasificar y regresiones

ML supervisado: es una técnica de aprendizaje automá3co en la que se entrena un


modelo u3lizando un conjunto de datos e3quetados que con3ene tanto las variables de
entrada como la variable de salida esperada. El obje3vo del modelo es predecir la variable
de salida para nuevas entradas que no han sido vistas antes.

ML no supervisado: En resumen, el aprendizaje no supervisado es una técnica de


aprendizaje automá3co en la que el modelo aprende de los datos no e3quetados para
descubrir patrones y estructuras ocultas sin tener conocimiento previo de las e3quetas o
resultados esperados. EJ: segmentación de clientes en el análisis de negocios, la
clasificación de imágenes sin e3quetas previas y la reducción de la dimensionalidad de los
datos.
Diferencia entre Clasificación y Regresión en ML supervisados

Diferencia entre Clustering, Asociación y Reducción de dimensionalidad en ML


supervisados
OverfiNng o sobre ajuste: es entrenar el modelo de manera que su desempeño es muy
preciso con los datos de entrenamiento, pero mal con “datos que no ha conocido”

Matriz de confusión:

Un algoritmo de ML se prueba dando un dataset de prueba y este se compara la salida


entregada con los valores verdaderos.

La validación cruzada consiste en probar el desempeño de un modelo con u enfoque que


divide un conjunto de datos N “fold” y usa uno de ellos para probarlo y el resto para
entrenarlo, pero esto lo hace con los N-fold y hace un resumen de los resultados, se
uEliza para comparar modelos.
FEATURE ENGINEERING: Consiste en la selección de variables o caracterís3cas de los datos
a u3lizar en el modelo con el fin de hacerlo desempeñar mejor y/o de forma más simple.

Metodología CRISP-DM: Es un modelo de proceso de minería de datos, este define un


proceso de 6 fases para guiar a los equipos de un proyecto de minería de datos en la
planificación, las fases son:
• Comprensión del negocio: Reunión con stakeholders para comprender obje3vos y
requerimiento del estudio/ minería de datos.
• Comprensión de datos: Recopilar y analizar los datos disponibles.
• Preparación de los datos: Limpieza, transformación y selección de datos.
• Modelado: se selecciona el algoritmo de modelado adecuado y se construye
modelos con los datos preparados.
• Evaluación : Se evalúa el rendimiento del modelo, se puede incluir validación
cruzada, la prueba de un conjunto de datos y comparar el modelo con los
requisitos del negocio.
• Despliegue/Explotación: Integración del modelo con aplicaciones del negocio.

Algunos algoritmos ML:


• Random Forest (RF): es un algoritmo de aprendizaje automá3co que u3liza
múl3ples árboles de decisión para construir un modelo. Cada árbol de decisión se
construye en una muestra aleatoria de los datos y se u3liza para predecir la clase
de un nuevo ejemplo. Luego, las predicciones de cada árbol se combinan para
llegar a una predicción final.

• Gradient BoosEng Machine (GBM): es un algoritmo de aprendizaje automá3co


que u3liza una serie de modelos débiles (por ejemplo, árboles de decisión) para
construir un modelo más fuerte. En cada iteración, el modelo intenta ajustar los
errores come3dos por el modelo anterior. El resultado final es un modelo de
conjunto que es muy preciso.

• Extreme Gradient BoosEng (XGB): es una implementación de GBM que u3liza


técnicas de regularización y una estrategia de división de hojas basada en
histogramas para mejorar la velocidad y la precisión del modelo. También u3liza el
paralelismo para acelerar el entrenamiento.

• Deep Learning (DL): es una técnica de aprendizaje automá3co que u3liza redes
neuronales ar3ficiales (ANN) para imitar el proceso de aprendizaje del cerebro
humano. Las ANN consisten en varias capas de neuronas ar3ficiales
interconectadas que procesan y transforman los datos de entrada para producir
una salida. DL se ha u3lizado en aplicaciones como la visión por computadora, el
procesamiento del lenguaje natural y la robó3ca.
Matriz de confusión: Ayuda a visualizar y cuan3ficar el rendimiento de un modelo de
clasificación al proporcionar información sobre cómo se están realizando las predicciones
en cada clase y qué 3pos de errores se están come3endo. Esto permite evaluar la precisión
y el poder de discriminación del modelo en diferentes situaciones.

Regresión logísEca: La regresión logís3ca es un algoritmo u3lizado para la clasificación


binaria, que es3ma la probabilidad de pertenencia a una clase u3lizando una función
logís3ca y ajustando los coeficientes durante el entrenamiento para maximizar la precisión
de las predicciones.

También podría gustarte