Fundamentos de Data
Science con Python
Sesión 1: Introducción a Data
Science y Python
Dr. Julio Lopez-Nunez
Diciembre, 2025
1
Sesión Objetivos
• Comprender qué es Data Science y su relevancia en ingeniería y negocios.
• Identificar el rol del Data Scientist.
Sesión 1
• Conocer notebooks interactivos (Google Colab, CoCalc).
Agenda
• Manipular datos básicos con pandas y numpy.
• Comprender qué es el Análisis Exploratorio de Datos (EDA).
• Detectar problemas comunes en los datos: valores faltantes, duplicados, tipos incorrectos.
Sesión 2 • Aplicar técnicas de limpieza básica en Python con pandas.
• Generar visualizaciones iniciales con matplotlib y seaborn.
• Desarrollar criterios para interpretar patrones y tendencias.
• Comprender qué es Machine Learning y sus tipos.
• Diferenciar entre regresión y clasificación.
02 al 04 dic. Sesión 3
• Entrenar modelos simples con scikit-learn.
• Evaluar la calidad de los modelos (métricas básicas).
09 al 11 dic. • Comprender los fundamentos de las redes neuronales artificiales y su relación con el aprendizaje automático
tradicional.
Sesión 4 • Conocer conceptos clave de Deep Learning: neuronas, capas, activaciones.
• Comprender el perceptrón.
• Comprender la red neuronal multicapa (MLP).
18:00 a 21:30 • Comprender conceptos avanzados de redes neuronales.
Sesión 5 • Conocer CNN y Transfer Learning de forma intuitiva.
• Reflexionar sobre riesgos, sesgos y uso ético de la IA.
• Presentar y evaluar el proyecto final integrador del curso.
Sesión 6 • Integrar todas las herramientas aprendidas (EDA, ML, Deep Learning).
• Reflexionar sobre desafíos reales al aplicar Ciencia de Datos.
2
Objetivos Comprender qué es Data
Science y su relevancia en
ingeniería y negocios.
Identificar el rol del Data
Scientist.
de la
sesión.
Conocer notebooks Manipular datos básicos
interactivos (Google con pandas y numpy.
Colab, CoCalc).
3
Definición: Ciencia interdisciplinaria (estadística +
programación + conocimiento del dominio).
Ciclo de vida:
¿Qué es
Obtención de datos
Data
Limpieza/preparación
Science?
Análisis exploratorio
Modelado/predicción
Comunicación de resultados
Aplicaciones en negocios, ingeniería, salud, ciencias sociales.
4
(1) Ref: Qué es el Data Science: Conceptos y Diferencias
Perfil híbrido:
Estadística y Conocimiento del
contexto.
El rol del Programación
(Python, R).
Data
Scientist. Habilidades
Enfoque ético en el
esenciales: Análisis,
uso de datos.
ML, Comunicación.
5
Lenguaje abierto, versátil, con gran
comunidad.
Entornos: Google Colab y CoCalc.
Introducción
a Python.
Bibliotecas clave: numpy, pandas,
matplotlib, seaborn, scikit-learn.
Ejemplo:
About Google Colaboratory
print("Hola, Ciencia de Datos!")
(1) Historia: [Link]
6
(2) Entorno: [Link]
Arreglos numéricos.
Operaciones vectorizadas.
Primeros
pasos con
numpy. Ejemplo:
import numpy as np
arr = [Link]([10, 20, 30])
print([Link](arr))
(1) Historia: [Link]
7
(2) Documentación: [Link]
Tablas de datos: DataFrames.
Importar, explorar, limpiar.
Tareas comunes
con Pandas.
Métodos básicos:
.head(), .info(), .describe().
Ejemplo: cargar CSV en Colab.
(1) Historia: [Link]
8
(2) Documentación: [Link]
Actividad práctica.
Importar un dataset (ejemplo: CSV con estudiantes o ventas).
Explorar filas y columnas.
Identificar valores faltantes.
Discusión de hallazgos iniciales.
9
Pregunta guía:
Discusión
grupal.
¿Cómo aplicarían la Ciencia
de Datos en sus áreas de
enseñanza o investigación?
“If you torture the data long enough, it will confess.” – atribuido a Ronald Coase
¿Qué creen ustedes?…
¿Se trata de aprovechar al máximo la información o de manipularla para confirmar sesgos?
10
Definición y ciclo de Rol del Data Scientist.
Data Science.
Cierre de la
sesión 1.
Conocer notebooks Primer análisis de
interactivos (Google datos con numpy y
Colab, CoCalc). pandas.
11