Python para Análisis de Datos
1. Introducción y Entorno 2. Fundamentos de Python 3. Cómputo con NumPy
Bibliotecas Esenciales Semántica del Lenguaje ndarray: Array Multidimensional
NumPy: Base para cómputo de arrays Indentación en lugar de llaves Tipos de datos (dtype)
pandas: Estructuras de datos de alto nivel Todo es un objeto Aritmética entre arrays
matplotlib: Visualización 2D Tipos escalares: None, str, bytes, float, Indexación básica y slicing
IPython y Jupyter: Computación interactiva bool, int Indexación booleana y fancy indexing
SciPy: Algoritmos cientı́ficos Control de flujo: if, elif, else, for, while, Transposición y cambio de ejes
scikit-learn: Machine learning pass
Operaciones y Algoritmos
statsmodels: Análisis estadı́stico Estructuras de Datos Integradas Funciones Universales (ufunc)
Herramientas Interactivas Tuple: Inmutable de longitud fija Métodos matemáticos y estadı́sticos
Shell de IPython List: Longitud variable y mutable Álgebra lineal ([Link])
Jupyter Notebooks Dictionary: Pares clave-valor (hash maps) Generación de números aleatorios
Completado con Tab e Introspección Set: Colección desordenada de elementos únicos Broadcasting
Comandos mágicos ( %run, %timeit) Funciones y Archivos
Namespaces y alcance local
Funciones anónimas (Lambda)
Generadores e iteradores
Manejo de errores y excepciones
Interacción con el OS y archivos
1
4. Manipulación con pandas 5. Visualización y Tiempo
Estructuras de Datos Graficación
Series: Array etiquetado 1D API de matplotlib: Figuras y subplots
DataFrame: Tabular tipo hoja de cálculo Colores, marcadores y estilos
Index: Etiquetas de ejes y metadatos Anotaciones en subplots
Visualización avanzada con seaborn
Funcionalidad Esencial
Reindexación y alineación de datos Análisis de Series Temporales
Eliminar entradas de un eje (drop) Tipos de datos de fecha (datetime)
Selección con loc e iloc Rangos, frecuencias y desplazamientos
Ordenamiento y ranking Manejo de zonas horarias (pytz)
Remuestreo y conversión
Wrangling de Datos
Funciones de ventana móvil (rolling)
Carga: CSV, JSON, Excel, SQL
Datos faltantes: dropna, fillna
Transformación: duplicados, mapeo
6. Modelado Estadı́stico
Combinación: merge, concat
Remodelación: stack, unstack, pivot Interfaz entre pandas y código de modelo
Descripciones de modelos con Patsy
Agregación y Operaciones de Grupo
statsmodels: Introducción a modelos lineales y
Mecánica Split-Apply-Combine series temporales
Iteración sobre grupos scikit-learn: Introducción a algoritmos de clasi-
Tablas dinámicas y crosstab ficación, regresión y clustering