0% encontró este documento útil (0 votos)
3 vistas28 páginas

01 Machine Learning

La clase de Machine Learning, impartida por el Ph.D. Miguel Angel Paco Escobar, cubre aspectos fundamentales del aprendizaje supervisado y no supervisado, así como actividades prácticas para desarrollar proyectos. Se enfatiza la importancia de la puntualidad, asistencia mínima, y el uso de herramientas colaborativas como Git Lab y Clickup. Además, se presentan conceptos clave del Machine Learning, su proceso de modelado y ejemplos prácticos de regresión lineal.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
3 vistas28 páginas

01 Machine Learning

La clase de Machine Learning, impartida por el Ph.D. Miguel Angel Paco Escobar, cubre aspectos fundamentales del aprendizaje supervisado y no supervisado, así como actividades prácticas para desarrollar proyectos. Se enfatiza la importancia de la puntualidad, asistencia mínima, y el uso de herramientas colaborativas como Git Lab y Clickup. Además, se presentan conceptos clave del Machine Learning, su proceso de modelado y ejemplos prácticos de regresión lineal.
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Machine Learning

DOCENTE: PH.D. MIGUEL ANGEL PACO ESCOBAR


Contenido de la clase

1. Consideraciones importantes de la materia


2. Repaso de aprendizaje supervisado y no supervisado
3. Actividad 1: Team building
4. Actividad 2: Selección de 3 propuestas de proyecto
5. Profundización de Machine Learning (ML)
CONSIDERACIONES IMPORTANTES

 Puntualidad. Llegue puntual a clases (se dará 10 minutos máximo de tolerancia, luego se considerará
inasistencia)
 Prácticas. Dedique regularmente tiempo para resolver las prácticas y/o proyecto de la asignatura.
 % asistencia mínima. Favor observe el cumplimiento mínimo del 75% de asistencia a clases para tener
derecho a la evaluación final y eventualmente la prueba recuperatoria.
 Uso de celulares. Para mitigar la distracción en clases, queda prohibido el uso de celular, salvo cuando
así se le permita.
 Equipo personal. Debe contar con su equipo personal (portátil) para efectuar en este sus prácticas
tanto individuales o de equipo.
 Bitácora escrita de actividades. Debe contar con un cuaderno donde registre lo relevante de
prácticas tanto individuales o de equipo (esbozos, ideas, decisiones, estructuras, etc.). En este debe
estar registrado también lo coordinado con su equipo.
 Git Lab. Debe tener registrado sus proyectos en Git Lab, para evidencias de sus trabajos.
 Trabajo colaborativo. Debe desarrollar sus skills de trabajo colaborativo en equipo; puede usar Clickup,
Trello u otro.

Ph.D. Miguel Angel Paco Escobar


Actividad 1: Repaso de aprendizaje
supervisado y no supervisado

 Ingrese al link [Link]


Introducción: ¿Por qué ML?

 Competencia de la Unidad: El participante podrá identificar


oportunidades de implementación de una solución de ML y comprender
el proceso de implementación para Clasificación y Regresión.
 ¿Por qué estamos aquí? ML está en la intersección de la estadística, la IA
y la informática.
El Contexto: ML vs. Reglas Manuales

¿Qué es Machine Learning (ML)?


 Un campo de estudio que da a las computadoras la capacidad de
aprender sin ser programadas explícitamente.
 Una colección de algoritmos que aprenden de los datos para hacer
predicciones e inferencias.
 Alternativa a la programación tradicional, que usa instrucciones estáticas
El Problema de las Reglas Codificadas
a Mano

 Los sistemas iniciales usaban reglas de decisión manuales ("if/else").


 Funciona solo para aplicaciones donde los expertos humanos tienen una
buena comprensión del proceso.
 Desventajas: La lógica es específica de un único dominio (poca
generalización) y requiere una comprensión profunda por parte del
experto.
 Es prácticamente imposible para tareas de alta complejidad (ej.
detección de rostros)
Ejem: Programación tradicional

 Uso de condicionales implica conocimiento de las reglas de negocio (típico


en sistemas expertos)
 If (…..) and (….)
 Else if(….)
 Else if (…)
 Elser if (…)

 Dependen altamente del know how de los expertos


 Dependen del uso de lógica implícita, aprendida del negocio
 Dependen de fórmulas o funciones ya estudiadas y/o teoría sustentada
ML como Solución a la Complejidad

 La Tarea: Clasificación de spam.


 Enfoque Manual: Crear una "lista negra" de palabras que marquen un
correo como spam.
 Enfoque ML: Presentar al algoritmo pares de entrada y salida deseada
(correos y su etiqueta "spam" o "no spam").
 Conclusión: ML permite que el programa automatice los procesos de
toma de decisiones al generalizar a partir de ejemplos conocidos. El
algoritmo aprende por sí mismo las características requeridas para hacer
la identificación
Conceptos Fundamentales

 La definición más influyente de ML, acuñada por Arthur Samuel en 1959, lo describe
como el "Campo de estudio que da a las computadoras la capacidad de aprender sin
ser explícitamente programadas".
 En términos de funcionalidad y proceso:
 El objetivo fundamental del ML es predecir resultados basándose en datos de entrada.
 Es una colección de algoritmos y técnicas utilizadas para crear sistemas computacionales
que aprenden de los datos con el fin de hacer predicciones e inferencias.
 Implica el estudio y la construcción de algoritmos que pueden aprender a partir de datos.
 Estos algoritmos construyen un modelo a partir de entradas de ejemplo para tomar
predicciones o decisiones basadas en datos, en lugar de seguir instrucciones de
programas estrictamente estáticas.
 Los modelos de ML son una clase de algoritmos informáticos diseñados para mejorar su
rendimiento en tareas específicas aprendiendo de los datos.
Definición de Machine Learning (ML)

 Machine Learning es un campo de investigación que se encuentra en la


intersección de la estadística, la inteligencia artificial (IA) y la informática.
Es un subcampo de la informática que se originó a partir del estudio del
reconocimiento de patrones y la teoría del aprendizaje computacional
dentro de la IA. Por esta razón, también es conocido como análisis
predictivo o aprendizaje estadístico
Definición de Machine Learning (ML)

“Es una rama de la inteligencia artificial (IA) y la informática que se centra en


el uso de datos y algoritmos para imitar la forma en que los humanos
aprenden. Los modelos de aprendizaje automático son una clase de
algoritmos diseñados para mejorar su rendimiento en tareas específicas
mediante el aprendizaje a partir de datos. Esto los diferencia de los
algoritmos tradicionales, donde las mejoras generalmente implican cambios
en el código del software.” Madhavan, G. (2025)
Fuente: Vastrik. (2018)
Fuente: Vastrik (2018)
Mapa del mundo ML

Fuente: Vastrik (2018)


Proceso y Tareas Previas al Modelado
de ML
Proceso y Tareas Previas al Modelado
dede ML
1. El Ciclo Vida del Proyecto

El ML es solo una parte de un proceso más amplio para resolver un problema. Existen marcos de trabajo
estandarizados para guiar este proceso iterativo:
KDD (Knowledge Discovery Databases): El proceso total para descubrir conocimiento útil a partir de datos. Sus
etapas incluyen:
 Selección: Integración y recuperación de datos objetivo.
 Preprocesamiento y Limpieza: Manejo de datos incompletos, ruidosos o inconsistentes (errores y valores atípicos).
 Transformación: Consolidar datos en formas apropiadas para el modelado, como la reducción de
dimensionalidad.
CRISP-DM (Cross-Industry Standard Process for Data Mining): La metodología más utilizada, que incluye seis fases
iterativas:
 Comprensión del Negocio (Business Understanding).
 Comprensión de los Datos (Data Understanding).
 Preparación de los Datos (Data Preparation).
 Modelado.
 Evaluación.
 Despliegue.
Proceso y Tareas Previas al Modelado
dedeML
2. Tareas Definición y Planificación (Fase Inicial)

Antes de tocar cualquier algoritmo, es crucial definir el problema y las expectativas:


• Definición del Problema: ¿Qué pregunta(s) se intentan responder?.
• Formulación ML: ¿Cuál es la mejor manera de expresar la pregunta como un
problema de ML (e.g., Clasificación Binaria, Regresión)?.
• Medición del Éxito: ¿Cómo se medirá el éxito de la aplicación (Métricas de
negocio)?.
Proceso y Tareas Previas al Modelado
dePrevias:
3. Tareas ML Adquisición y Preparación de Datos
La calidad de la predicción depende de la calidad de los datos de entrada.
Tambien la calidad de la predicción esta en función del volumen de datos (a mayor
cantidad => mayor precisión)
La representación de los datos es la pieza más importante para el éxito.
Esta predicción también depende de los datos que se elijan procesar.
Proceso y Tareas Previas al Modelado
dePrevias:
3. Tareas ML Adquisición y Preparación de Datos
N° TAREA DESCRIPCION Y OBJETIVOS
1 Recolección y Muestreo ¿Se ha recogido suficiente data para representar el
problema?. El muestreo se usa para entrenar modelos
en conjuntos de datos grandes de manera eficiente
2 Inspección de Datos (EDA) Analizar las propiedades básicas, la tendencia central,
la variabilidad y la distribución de los datos para
detectar patrones y valores atípicos (outliers)
3 Representación de Datos Convertir los datos de entrada a un formato que la
(representación tabular) computadora pueda entender, típicamente una tabla.
Cada fila es una muestra y cada columna es una
característica (feature).
4 Ingeniería de Características Crear una buena representación de los datos. Esto
incluye agregar, dividir o combinar características. El
conocimiento experto es clave para identificar
características útiles
Proceso y Tareas Previas al Modelado
dePrevias:
3. Tareas ML Adquisición y Preparación de Datos
N° TAREA DESCRIPCION Y OBJETIVOS
5 Preprocesamiento y Escalamiento Ajustar características para que la representación de
datos sea adecuada para los algoritmos
(especialmente sensibles como SVMs y Redes
Neuronales). Tareas comunes: normalización y
estandarización y limpieza (depuración)
6 Manejo de Variables Categóricas Transformar variables no numéricas (como texto) en
formato numérico. Técnicas comunes incluyen One-Hot-
Encoding (variables dummy) o Label Encoding
7 Manejo de Valores Nulos Identificar y tratar valores faltantes (NaN) para evitar
que perjudiquen el rendimiento del modelo
8 Partición de Datos Dividir el conjunto de datos en entrenamiento (para
construir el modelo) y prueba (para evaluar la
generalización en datos nunca antes vistos)
Actividad 2: Ejemplo Práctico:
Predicción de la Calificación
(Regresión Lineal Simple)
1. La Pregunta de Negocio (Objetivo)
 Problema: Queremos estimar la Calificación Final del Examen (y) de un
estudiante basándonos únicamente en sus Horas de Estudio (x).
 Formulación ML: Esto es una tarea de Regresión, ya que predecimos un
valor continuo o numérico (la calificación, que puede ser cualquier
número en un rango).
Actividad 2: Ejemplo Práctico:
Predicción de la Calificación
(Regresión Lineal Simple)
2. Los Datos Históricos (Muestras)
 Usamos un pequeño conjunto de datos (tabla)
para encontrar el patrón
 y= f(x)
 y = mx + c
Actividad 2: Ejemplo Práctico:
Predicción de la Calificación
(Regresión Lineal Simple)
3. El Modelo: Encontrando la Ecuación
La regresión lineal busca la línea recta que mejor se ajusta (line of best fit) a estos puntos de datos, minimizando el
error total (e). La ecuación general que el modelo de ML aprende es:
Y =m⋅X+c+e
Donde:
Y : La calificación estimada.
X: Horas de estudio.
m: La pendiente (coeficiente de regresión).
c: El intercepto.
Al aplicar el algoritmo (usando LinearRegression de Scikit-learn), obtenemos los parámetros óptimos (m y c):
• Pendiente (m): 4.74 (Coeficiente)
• Intercepto (c): 52.29
Actividad 2: Ejemplo Práctico:
Predicción de la Calificación
(Regresión Lineal Simple)
El Modelo
La ecuación es: y=4.74x + 52.29
Actividad 2: Ejemplo Práctico:
Predicción de la Calificación
(Regresión Lineal Simple)
Evaluación del Modelo
Para saber qué tan bien funciona este modelo, usamos métricas:
• R-cuadrado (R2 ): 0.9757
◦ Interpretación: El 97.57% de la variabilidad en la calificación (Y) se explica por las horas de
estudio (X). Como el valor está cerca de 1, el ajuste del modelo es excelente.
• Error Absoluto Medio (MAE): 1.62
◦ Interpretación: En promedio, la predicción del modelo se desvía de la calificación real por
1.62 puntos.
Actividad 3: Regresión lineal con
Python
Tarea individual
 Usando Jupyter Notekook, en base al Proyecto
[Link]
lineal/notebook
 1) Analice el código fuente y ejecute todos los comandos tal como se
describen.
 2) Elabore un documento con dicho programa, complementando los
comandos con comentarios (#) que le ayuden a recorder el propósito de
cada linea y remita ese documento en word, Junto con el archivo
generado por notebook (.ipynb)
Fecha de entrega: 25/11/2025 hrs 12:00
BIBLIOGRAFIA

 Madhavan, G. (2025). Mastering Machine Learning: From Basics to


Advanced. Transactions on Computer Systems and Networks. Springer
Nature Singapore Pte Ltd. [Link]
 Vastrik. (2018). Machine Learning for Everyone — In simple words. .
Recuperado de [Link]. [Link]

También podría gustarte