DOC #02
Machine Learning y Deep
Learning
El motor del aprendizaje automático moderno
Serie Documentos de Inteligencia Artificial | 2025
1. Machine Learning: Aprender de los Datos
El Machine Learning (ML) es un subcampo de la IA que permite a los sistemas mejorar
automáticamente su rendimiento a través de la experiencia, sin ser programados de forma explícita
para cada tarea. Los algoritmos de ML identifican patrones en los datos y construyen modelos
predictivos.
1.1 Tipos de Aprendizaje
Tipo Descripción Ejemplo
Aprende con datos etiquetados Spam detection, precios de
Supervisado
(entrada-salida). Clasificación, regresión. viviendas
Descubre patrones sin etiquetas. Clustering, Segmentación de clientes,
No Supervisado
reducción de dimensionalidad. anomalías
Aprende mediante recompensas y
Por Refuerzo Juegos, robótica, trading
penalizaciones en un entorno.
Combina pocos datos etiquetados con
Semi-supervisado Clasificación de texto médico
muchos no etiquetados.
2. Algoritmos Fundamentales de ML
• Regresión Lineal y Logística: modelos estadísticos para predecir valores continuos o
probabilidades.
• Árboles de Decisión y Random Forest: modelos basados en reglas de decisión anidadas.
• Support Vector Machines (SVM): clasificación con hiperplanos de máximo margen.
• K-Nearest Neighbors (KNN): clasifica según los k vecinos más cercanos en el espacio de
características.
• Gradient Boosting (XGBoost, LightGBM): ensamblado de modelos débiles para alta precisión.
• K-Means Clustering: agrupa datos en k clusters según distancia al centroide.
3. Deep Learning: Redes Neuronales Profundas
El Deep Learning (DL) es una especialización del ML que utiliza redes neuronales artificiales con
múltiples capas ocultas. Cada capa aprende representaciones más abstractas de los datos,
permitiendo al modelo capturar patrones complejos que los algoritmos clásicos no pueden detectar.
3.1 Arquitecturas Principales
Arquitectura Uso Principal Ejemplos
CNN (Convolutional) Procesamiento de imágenes y video ResNet, VGG, EfficientNet
Página 2
RNN / LSTM Secuencias temporales y texto Predicción de series, traducción
Transformer Atención sobre secuencias largas GPT, BERT, T5
GAN Generación de datos sintéticos Deepfakes, arte generativo
Autoencoder Compresión y reconstrucción Detección de anomalías
Diffusion Models Generación imagen/audio Stable Diffusion, Sora
4. El Proceso de Entrenamiento
Entrenar una red neuronal implica ajustar millones (o miles de millones) de parámetros para minimizar
una función de pérdida. El proceso sigue estos pasos:
• Paso 1: Inicialización aleatoria de pesos del modelo.
• Paso 2: Forward pass: propagación de los datos a través de las capas.
• Paso 3: Cálculo del error (loss) entre la predicción y el valor real.
• Paso 4: Backpropagation: cálculo del gradiente de la pérdida respecto a cada parámetro.
• Paso 5: Actualización de pesos mediante optimizadores (Adam, SGD, AdaGrad).
• Paso 6: Repetición durante múltiples épocas hasta convergencia.
5. Métricas de Evaluación
Métrica Descripción Aplicación
Accuracy Porcentaje de predicciones correctas Clasificación balanceada
Precision / Recall Balance entre falsos positivos y negativos Detección de fraudes, spam
F1-Score Media armónica de precision y recall Datasets desbalanceados
MAE / RMSE Error absoluto y cuadrático medio Regresión numérica
AUC-ROC Capacidad discriminativa del modelo Diagnóstico médico
Perplexity Calidad de modelos de lenguaje LLMs, traducción
El Deep Learning ha superado al ser humano en tareas de visión computacional,
juegos de estrategia y comprensión del lenguaje, marcando una nueva era en la
historia de la IA.
Página 3