CURSO
DATA SCIENCE
TABLA DE CONTENIDOS
➞ Introducción a ciencia de datos.
➞ Metodologías ágiles.
➞ Ciclo de vida de los datos.
➞ Metodología CRISP-DM.
➞ Git y control de versiones.
➞ Python como herramienta central de
análisis estadístico.
➞ Introducción a los algoritmos con Python
➞ Estadística descriptiva.
➞ Estadística inferencial y probabilidad.
➞ Características de los datos. Calidad de
datos.
FUNDAMENTOS DE CIENCIA DE DATOS
➞ Transformación de datos (Numpy,
Pandas).
➞ Manipulación y limpieza de datos con
Python.
➞ Análisis exploratorio de datos.
➞ Definición de problema con estrategia
SMART.
➞ Bases de datos relacionales y no
relacionales.
➞ Ingesta de archivos en bases de datos.
➞ Variables, funciones y procedimientos.
➞ Subconsultas, expresiones de tablas
comunes (CTEs), vistas y funciones
ventana.
➞ Optimización de consultas.
➞ Triggers y carga incremental.
➞ Bases de datos relacionales en Python.
➞ Diseño de gráficas
➞ Visualizaciones.
➞ Creación de diagramas y gráficos.
➞ Uso de estadísticas para identificar
patrones.
VISUALIZACIONES ➞ Correlación y regresión.
➞ Power BI, Power Query, DAX.
➞ KPIs y Business Applications.
➞ Data Storytelling.
➞ Estrategias de presentación efectivas.
➞ Introducción a Data Engineering.
➞ Proceso de ETL y ELT de datos.
➞ SQL Server, Postgres SQL, MySQL.
➞ Hadoop ecosystem para el trabajo con Big
Data.
➞ Cloud data engineering.
➞ Diseño de data pipelines.
➞ Monitoreo del estado de los datos.
DATA ENGINEERING
➞ Container-based applications en Docker.
➞ Manejo de bases de datos en ecosistemas
en la nube (GCP, AWS, Azure) e
implementación de soluciones en la
misma.
➞ Contenedores y orquestación: Docker,
Kubernetes.
➞ Orquestación de workflows con Apache
Airflow.
➞ ¿Qué es machine learning? vs. IA
➞ Extracción de insights de datos.
➞ Modelamiento supervisado
➞ Métricas de evaluación para modelos
supervisados.
➞ Validación cruzada.
➞ Ajuste de hiperparámetros.
MACHINE LEARNING ➞ Modelamiento no supervisado.
➞ Series de tiempo.
➞ Métodos de ensamble.
➞ Procesamiento de lenguaje natural e IA
generativa
➞ Trabajo con data pipelines.
➞ Entornos virtuales y APIs
➞ Buenas prácticas de ingeniería de software
➞ MLOps
➞ Herramientas y librerías
➞ Redes neuronales.
➞ Deep learning
➞ Aprendizaje por refuerzo
➞ Entrenamiento con big data
➞ Reentrenamiento del modelo
➞ Diseño de pipelines de Machine Learning
automatizados.
ESPECIALIZACIÓN: MACHINE LEARNING
➞ Estrategias de despliegue de modelos:
batch, online, streaming.
➞ Modelos en contenedores con Docker
➞ Consideraciones de seguridad y
privacidad.
➞ Automatización y validación de código.
➞ IA como herramienta para agilizar el
trabajo. Aprendizaje automatizado.
➞ Consideraciones éticas y sociales en el
uso de IA. Explicabilidad.
➞ Python.
➞ Técnicas de ingesta de datos.
➞ Arquitectura de Data Lakes y Data
Warehouses.
➞ Herramientas para la ingesta de datos:
Apache Kafka, Flume, etc.
➞ Procesamiento en batch: Apache Spark,
Apache Flink.
➞ Procesamiento en tiempo real: Apache
Storm, Apache Samza.
➞ Calidad de datos.
ESPECIALIZACIÓN: DATA ENGINEERING
➞ Big Data.
➞ Azure Data Factory, Databricks.
➞ Principios de data governance y seguridad
en la nube.
➞ Herramientas de ETL Cloud-NativeNoSQL.
➞ Técnicas de optimización de consultas en
SQL y NoSQL.
➞ Estrategias de escalabilidad horizontal y
vertical.
*El curso puede sufrir modificaciones con el objetivo de la mejora de la experiencia.