0% encontró este documento útil (0 votos)
5 vistas37 páginas

Modulo 7

El módulo 7 de Fundamentos de Análisis de Datos se centra en las bases de datos relacionales y el uso de SQL para gestionar y consultar datos de manera eficiente. Se abordan conceptos clave como motores de bases de datos, elementos de una base de datos, y la importancia de un modelo de datos bien estructurado para la toma de decisiones en las organizaciones. Al finalizar, los participantes adquirirán habilidades prácticas para interactuar con bases de datos y extraer información relevante.

Cargado por

middernacht.sq
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
5 vistas37 páginas

Modulo 7

El módulo 7 de Fundamentos de Análisis de Datos se centra en las bases de datos relacionales y el uso de SQL para gestionar y consultar datos de manera eficiente. Se abordan conceptos clave como motores de bases de datos, elementos de una base de datos, y la importancia de un modelo de datos bien estructurado para la toma de decisiones en las organizaciones. Al finalizar, los participantes adquirirán habilidades prácticas para interactuar con bases de datos y extraer información relevante.

Cargado por

middernacht.sq
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 01

Contenido
INTRODUCCIÓN ............................................................................................................. 1
MOTOR DE BASE DE DATOS ............................................................................................. 2
ELEMENTOS DE UNA BASE DE DATOS .............................................................................. 2
ELEMENTOS DE UN MODELO DE DATOS .......................................................................... 3
LAS BASES DE DATOS RELACIONALES ............................................................................. 3
El rol de las bases de datos relacionales en la organización........................................... 3
CARACTERÍSTICAS DE UN RDBMS ................................................................................... 4
¿QUÉ ES SQL Y PARA QUÉ SIRVE? .................................................................................... 5
ELEMENTOS CONFORMANTES DE UNA BASE DE DATOS .................................................. 5
Definición de una Base de Datos .................................................................................. 5
Usuarios y permisos en una Base de Datos ................................................................... 5
ELEMENTOS CONFORMANTES DE UN MODELO DE DATOS .............................................. 6
Entidades, atributos e identificadores .......................................................................... 6
TABLA RESUMEN - Base de Datos Relacional ................................................................... 6

INTRODUCCIÓN

En el mundo actual, donde los datos son el nuevo petróleo, comprender cómo se almacenan
y organizan es fundamental para cualquier profesional que quiera tomar decisiones
informadas. Las bases de datos son el pilar sobre el cual se construye la gestión de
información en empresas de todos los sectores, permitiendo estructurar, almacenar y
recuperar datos de manera eficiente. Un analista de datos debe conocer los fundamentos de
las bases de datos para poder extraer información relevante y convertirla en conocimientos
útiles para la organización.
Este módulo está diseñado para introducirte en el uso de bases de datos relacionales, el tipo
más común en la industria. Aprenderás qué son, cómo funcionan y por qué son esenciales en
el análisis de datos. También conocerás las herramientas y conceptos clave que te permitirán
interactuar con bases de datos a través de SQL, un lenguaje universal utilizado para gestionar
y consultar datos.
Al finalizar este módulo, tendrás las habilidades necesarias para comprender y aplicar los
elementos de una base de datos en la resolución de problemas del mundo real. No necesitas
experiencia previa en bases de datos ni conocimientos técnicos avanzados. Aquí aprenderás
de manera práctica y con ejemplos claros, pensando siempre en cómo estas herramientas
pueden facilitar tu trabajo diario como analista de datos.
1
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 01

MOTOR DE BASE DE DATOS


Un motor de base de datos es el software que permite almacenar, administrar y recuperar
datos de forma estructurada. Existen varios tipos de motores, pero los más utilizados en la
industria son los motores de bases de datos relacionales (RDBMS), como MySQL, PostgreSQL
y SQL Server. Estos motores permiten que múltiples usuarios accedan a la información de
manera simultánea y segura, garantizando la integridad de los datos.
Una de sus principales características es el uso de SQL (Structured Query Language), un
lenguaje estándar para realizar consultas y operaciones en la base de datos. Gracias a SQL,
los analistas pueden extraer información específica sin necesidad de manipular directamente
los archivos de datos.

"Las bases de datos relacionales permiten almacenar, organizar y


recuperar información estructurada mediante motores como
MySQL, PostgreSQL y SQL Server, utilizando SQL para realizar
consultas y gestionar datos eficientemente."

Por ejemplo, imagina que una tienda de e-commerce necesita conocer cuántos productos se
vendieron en la última semana. En lugar de revisar miles de registros manualmente, se puede
ejecutar una consulta SQL que devuelva el total de ventas en segundos.

Motores de Base de datos

ELEMENTOS DE UNA BASE DE DATOS


Las bases de datos están compuestas por diversos elementos que permiten organizar la
información de forma estructurada. Entre estos elementos destacan las tablas, que
2

almacenan los datos en filas y columnas; los usuarios y permisos, que controlan el acceso a
Página

la información; y las vistas, que permiten generar representaciones filtradas de los datos.
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 01

En la práctica, el correcto uso de estos elementos facilita la gestión y seguridad de la


información. Por ejemplo, en un hospital, los datos de los pacientes deben ser accesibles solo
para el personal autorizado. A través de la configuración de permisos en la base de datos, se
puede garantizar que los médicos puedan ver los historiales clínicos, mientras que el personal
administrativo solo pueda acceder a la información de facturación.

Tablas, usuarios y permisos

ELEMENTOS DE UN MODELO DE DATOS


Un modelo de datos define la forma en que los datos se organizan dentro de una base de datos.
Incluye entidades (objetos que representan información, como clientes o productos), atributos
(características de esas entidades, como nombre o precio) y las relaciones entre ellas.
En el ámbito empresarial, un modelo de datos bien estructurado mejora la eficiencia en la
recuperación de información. Por ejemplo, en una empresa de logística, se necesita saber
cuántos pedidos han sido entregados en una región específica. Gracias al modelo de datos, se
pueden realizar consultas SQL que crucen la información de clientes, pedidos y ubicaciones
para obtener este resultado de manera rápida y precisa.

LAS BASES DE DATOS RELACIONALES


El rol de las bases de datos relacionales en la organización
Las bases de datos relacionales permiten estructurar información de manera organizada y
optimizada para su uso en las empresas. Gracias a su diseño basado en relaciones entre
tablas, se evita la duplicidad de información y se mejora la eficiencia en las consultas.
Por ejemplo, en una tienda minorista, los datos de clientes y sus compras pueden almacenarse
en dos tablas separadas. En lugar de repetir la información del cliente en cada compra, se
mantiene una relación entre ambas tablas para acceder a los datos de manera eficiente.
3
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 01

"Las bases de datos relacionales organizan información en tablas


conectadas por relaciones, evitando duplicidad y optimizando
consultas mediante modelos estructurados que facilitan la
recuperación y gestión eficiente de datos."

CARACTERÍSTICAS DE UN RDBMS
Un sistema de gestión de bases de datos relacionales (RDBMS) es un software que permite
la administración eficiente de bases de datos. Algunas de sus características principales son
la integridad de datos, la concurrencia (varios usuarios pueden acceder al mismo tiempo) y la
seguridad mediante permisos y roles.
Por ejemplo, en una institución financiera, un RDBMS permite que los clientes realicen
transacciones sin riesgo de inconsistencia en los datos, asegurando que los registros sean
precisos y seguros.

Base de Datos Relacional


4
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 01

¿QUÉ ES SQL Y PARA QUÉ SIRVE?


SQL (Structured Query Language) es el lenguaje estándar para interactuar con bases de datos
relacionales. Permite realizar consultas, insertar, actualizar y eliminar datos, además de
administrar la estructura de la base de datos.
Por ejemplo, si en una tienda se quiere saber cuántos productos se han vendido en un mes, se
puede usar una consulta SQL como:

Esta consulta devuelve el total de ventas realizadas en ese período.

ELEMENTOS CONFORMANTES DE UNA BASE DE DATOS


Definición de una Base de Datos
Una base de datos es un conjunto organizado de información que permite almacenar y
recuperar datos de manera eficiente.
Por ejemplo, un sistema de reservas de vuelos almacena información sobre pasajeros, vuelos
y horarios en una base de datos, permitiendo a los clientes consultar disponibilidad y hacer
reservas en línea.

Base de Datos

Usuarios y permisos en una Base de Datos


Las bases de datos permiten asignar distintos niveles de acceso a los usuarios, asegurando la
seguridad de la información. Por ejemplo, en un banco, solo los cajeros pueden registrar
transacciones, mientras que los clientes solo pueden consultar su saldo.

"Un sistema de gestión de bases de datos relacionales (RDBMS)


permite almacenar, administrar y proteger información mediante
integridad de datos, concurrencia y control de acceso con SQL para
5

consultas y modificaciones estructuradas."


Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 01

ELEMENTOS CONFORMANTES DE UN MODELO DE DATOS


Entidades, atributos e identificadores
Las entidades representan objetos del mundo real dentro de una base de datos, como
empleados o productos. Los atributos son las características de estas entidades, y los
identificadores permiten distinguir cada registro.
Por ejemplo, en una base de datos de recursos humanos, la entidad Empleado puede tener
atributos como nombre, cargo y sueldo, y su identificador único puede ser el número de
empleado.

Elementos de un modelo de Datos

TABLA RESUMEN - Base de Datos Relacional

Elemento Descripción Ejemplo


Almacenan los datos en filas y Tabla de clientes con nombre,
Tablas
columnas dirección y teléfono
Consultas predefinidas que Vista de clientes activos en el
Vistas
muestran información filtrada último mes
Conjunto de instrucciones SQL
Procedimientos Procedimiento para calcular
almacenadas para automatizar
almacenados descuentos en pedidos
procesos
Vínculos entre tablas que
Relación entre clientes y sus
Relaciones permiten estructurar la
pedidos
6

información
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 02

Contenido
INTRODUCCIÓN ............................................................................................................. 1
SINTAXIS BÁSICA PARA EL LENGUAJE SQL ....................................................................... 2
SENTENCIAS CONDICIONALES EN EL LENGUAJE SQL ..................................................... 2
OPERACIONES DE CONJUNTO EN LENGUAJE SQL ........................................................... 3
CONSULTA A UNA SOLA TABLA ........................................................................................ 4
Selección de columnas de la consulta con la sentencia SELECT ................................... 4
Selección de la tabla con la sentencia FROM ................................................................ 4
Filtrado de datos con la sentencia WHERE .................................................................... 4
Sentencias IN y NOT IN ................................................................................................ 4
Between y operadores lógicos AND y OR....................................................................... 5
Utilización de funciones preconstruidas (MIN, MAX, AVG, COUNT) ................................ 5
La sentencia DISTINCT ................................................................................................. 5
OPERACIONES DE CONJUNTO: UNION, INTERSECT, EXCEPT ........................................... 5
TABLA RESUMEN – Lenguaje SQL ..................................................................................... 6

INTRODUCCIÓN

En el mundo actual, los datos son un recurso fundamental para la toma de decisiones en
cualquier organización. Sin embargo, tener una gran cantidad de datos no es suficiente si no
sabemos cómo acceder a la información clave dentro de ellos. Aquí es donde entran en juego
las bases de datos y las consultas SQL. Este módulo te enseñará cómo obtener información
específica de una base de datos de manera efectiva y eficiente.
A lo largo de este módulo, aprenderás a construir consultas básicas en SQL, el lenguaje más
utilizado para interactuar con bases de datos. Descubrirás cómo seleccionar los datos que
necesitas, filtrarlos de acuerdo a ciertos criterios y aplicar funciones que te permitirán obtener
información relevante. Con estas habilidades, podrás extraer conocimiento útil a partir de los
datos y tomar mejores decisiones en tu entorno laboral.
Al finalizar este módulo, serás capaz de elaborar consultas utilizando sentencias de selección
y filtrado de datos, lo que te permitirá acceder a la información de una manera estructurada y
organizada. Este conocimiento será clave para cualquier persona que trabaje con datos, sin
importar el área o la industria en la que se desempeñe.
1
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 02

SINTAXIS BÁSICA PARA EL LENGUAJE SQL


Para obtener información de una base de datos, necesitamos escribir consultas en SQL. La
estructura más común de una consulta básica sigue el formato:

SQL

La palabra clave SELECT indica qué información queremos recuperar, mientras que FROM
señala la tabla donde se encuentran esos datos. Imagina que tienes una lista de empleados en
una tabla llamada empleados. Si deseas ver sus nombres y correos electrónicos, escribirías:

SQL

Este simple comando te devolverá una lista con los nombres y correos electrónicos de todos
los empleados almacenados en la base de datos.

"SQL es el lenguaje estándar utilizado para consultar bases de


datos, permitiendo seleccionar, filtrar y extraer información
estructurada para la toma de decisiones basada en datos
organizados."

SENTENCIAS CONDICIONALES EN EL LENGUAJE SQL


Muchas veces, no queremos ver toda la información de una tabla, sino solo ciertos registros
que cumplan con una condición específica. Para ello, utilizamos la cláusula WHERE junto con
operadores condicionales como =, >, <, >=, <=, <> y !=.
Por ejemplo, si queremos obtener solo los empleados que ganan más de $2,000, podemos
escribir:

SQL
2
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 02

Además, podemos combinar varias condiciones usando AND y OR. Supongamos que
queremos ver los empleados que ganan más de $2,000 y que trabajan en el departamento de
ventas:

SQL

Este tipo de filtros ayuda a encontrar información específica y útil dentro de la base de datos.

OPERACIONES DE CONJUNTO EN LENGUAJE SQL


Las operaciones de conjunto en SQL nos permiten combinar los resultados de múltiples
consultas. Las más comunes son UNION, INTERSECT y EXCEPT.
• UNION une los resultados de dos consultas y elimina los duplicados.
• INTERSECT devuelve solo los registros que están presentes en ambas consultas.
• EXCEPT muestra los registros que están en la primera consulta, pero no en la segunda.
Por ejemplo, si tenemos dos tablas, clientes_chile y clientes_peru, y queremos obtener una
lista única de todos los clientes de ambos países, podemos usar:

SQL

Estas operaciones son útiles cuando necesitamos combinar o comparar datos de diferentes
fuentes dentro de una misma base de datos.

"Las sentencias condicionales en SQL permiten filtrar registros


utilizando la cláusula WHERE, operadores lógicos y combinaciones
de condiciones para obtener información específica dentro de una
base de datos."
3
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 02

CONSULTA A UNA SOLA TABLA


Selección de columnas de la consulta con la sentencia SELECT
Cuando trabajamos con bases de datos, no siempre necesitamos recuperar toda la
información disponible en una tabla. Usamos SELECT para elegir las columnas que queremos
ver. Por ejemplo, si tenemos una tabla productos y queremos ver solo los nombres y precios
de los productos, escribiríamos:
SQL

Este método nos permite obtener solo los datos necesarios, haciendo las consultas más
eficientes.

Selección de la tabla con la sentencia FROM


Para obtener datos en SQL, debemos indicar de qué tabla provienen. Esto lo hacemos con la
cláusula FROM. Si queremos ver todos los datos de la tabla clientes, podemos escribir:

SQL

El asterisco (*) indica que queremos seleccionar todas las columnas de la tabla.

Filtrado de datos con la sentencia WHERE


El WHERE nos permite filtrar los datos según condiciones específicas. Podemos usar
operadores como >, <, >=, <=, !=, y otros.
Por ejemplo, para obtener solo los clientes mayores de 30 años:
SQL

Sentencias IN y NOT IN
Nos permiten filtrar datos basándonos en una lista de valores.
Ejemplo:
SQL

Esto mostrará solo los empleados de esos departamentos.


4
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 02

"Las consultas SQL permiten seleccionar, filtrar y analizar datos


mediante sentencias como SELECT, WHERE, BETWEEN y funciones
agregadas, optimizando la recuperación de información relevante
en una base de datos."

Between y operadores lógicos AND y OR


BETWEEN nos permite seleccionar valores dentro de un rango.
Ejemplo:
SQL

Aquí se seleccionan solo los productos cuyo precio está entre $100 y $500.

Utilización de funciones preconstruidas (MIN, MAX, AVG, COUNT)


SQL ofrece funciones que nos ayudan a analizar los datos:
• MIN(): Encuentra el valor mínimo.
• MAX(): Encuentra el valor máximo.
• AVG(): Calcula el promedio.
• COUNT(): Cuenta el número de registros.

Ejemplo, para saber el salario más alto y más bajo de una empresa:
SQL

La sentencia DISTINCT
Si queremos obtener valores únicos, usamos DISTINCT.
Ejemplo, para ver todos los departamentos sin repetir:
SQL

OPERACIONES DE CONJUNTO: UNION, INTERSECT, EXCEPT


Como vimos antes, nos permiten combinar y comparar resultados de consultas.
Ejemplo de INTERSECT:
5
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 02

SQL

Este resultado mostrará solo los clientes que aparecen en ambas tablas.

TABLA RESUMEN – Lenguaje SQL

Concepto Descripción breve


SQL (Structured Query Lenguaje utilizado para gestionar y consultar bases de datos
Language) relacionales.
Permite seleccionar columnas específicas de una tabla para mostrar
SELECT
solo la información necesaria.
FROM Indica la tabla de donde se extraen los datos en una consulta SQL.
Filtra registros según condiciones específicas, utilizando operadores
WHERE
como =, >, <, >=, <=, !=.
IN y NOT IN Permiten filtrar datos basándose en una lista de valores específicos.
BETWEEN Selecciona valores dentro de un rango definido.
Operadores lógicos
Se utilizan para combinar múltiples condiciones en una consulta SQL.
(AND, OR)
Funciones agregadas
Operaciones predefinidas en SQL que permiten obtener valores
(MIN, MAX, AVG,
mínimos, máximos, promedios y contar registros.
COUNT)
Permite obtener valores únicos de una columna, eliminando
DISTINCT
duplicados.
Operaciones de
conjunto (UNION, Permiten combinar y comparar resultados de consultas en SQL.
INTERSECT, EXCEPT)
UNION Une los resultados de dos consultas y elimina duplicados.
INTERSECT Devuelve solo los registros que aparecen en ambas consultas.
Muestra los registros que están en la primera consulta, pero no en la
EXCEPT
segunda.
6
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 03

Contenido
INTRODUCCIÓN ............................................................................................................. 1
COMBINACIÓN DE TABLAS EN SQL ................................................................................. 2
CONCEPTO DE INTEGRIDAD REFERENCIAL ..................................................................... 3
Llave Primaria y Llave Foránea ...................................................................................... 3
DIFERENCIAS ENTRE LOS DISTINTOS TIPOS DE JOIN........................................................ 3
APLICACIÓN DE SENTENCIAS JOIN EN SQL ..................................................................... 4
CONSULTA A TABLAS RELACIONADAS ............................................................................. 5
Qué es un modelo de datos y cómo interpretarlo .......................................................... 5
Integridad referencial: Llaves Primarias y Foráneas ....................................................... 5
Consultas de selección con tablas relacionadas .......................................................... 5
COMBINACIÓN DE TABLAS: TIPOS DE JOIN...................................................................... 6
TABLA RESUMEN – Combinar Tablas ................................................................................ 6

INTRODUCCIÓN

En el mundo actual, la información es uno de los activos más valiosos para cualquier
organización. Sin embargo, los datos por sí solos no tienen mucho valor si no se pueden
organizar y analizar de manera eficiente. En este módulo, aprenderemos a construir consultas
sobre bases de datos, lo que permitirá extraer información clave para la toma de decisiones.
Usaremos SQL, un lenguaje diseñado específicamente para interactuar con bases de datos, lo
que facilitará la recuperación y combinación de datos de manera estructurada.
Muchas veces, la información relevante para una empresa no está almacenada en un solo
lugar, sino en diferentes tablas dentro de una base de datos. Para poder aprovechar esos datos,
es fundamental conocer cómo combinar información de distintas tablas, relacionarlas y
extraer lo necesario para responder preguntas o generar reportes. En este módulo, aprenderás
cómo funciona la integridad referencial, qué son las llaves primarias y foráneas, y cómo se
utilizan distintas técnicas de combinación de tablas en SQL.
Al finalizar este módulo, serás capaz de entender cuándo y por qué es necesario combinar
datos de múltiples tablas. También podrás construir consultas eficientes que te permitan
acceder a la información de manera estructurada y útil. Este conocimiento es esencial para
cualquier persona que desee trabajar con bases de datos y análisis de datos en entornos
empresariales o de investigación.
1
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 03

COMBINACIÓN DE TABLAS EN SQL


En la mayoría de los casos, una base de datos está compuesta por múltiples tablas que
contienen información diferente pero relacionada entre sí. Por ejemplo, en una empresa,
podríamos tener una tabla con los datos de los clientes y otra con los pedidos que han
realizado. Si queremos conocer qué cliente realizó un pedido específico, necesitaremos
combinar estas tablas.

"La combinación de tablas en SQL permite relacionar datos


almacenados en diferentes tablas mediante llaves primarias y
foráneas, optimizando la organización y recuperación de
información en bases de datos relacionales."

El uso de combinaciones de tablas se vuelve necesario cuando los datos que necesitamos no
se encuentran en una sola tabla. En estos casos, utilizamos distintas técnicas de combinación
para acceder a la información de manera estructurada y evitar errores en el análisis. También
es útil cuando queremos evitar la duplicación de datos, ya que nos permite almacenar la
información de manera más eficiente y recuperarla cuando sea necesario.
Por ejemplo, si trabajamos en un banco y queremos generar un informe de clientes con sus
cuentas y transacciones, necesitaremos combinar varias tablas que almacenen dicha
información. Sin una consulta adecuada que relacione los datos correctamente, sería muy
difícil obtener un reporte claro y útil.

2
Página

Combinación de tablas - Modelo


FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 03

CONCEPTO DE INTEGRIDAD REFERENCIAL


Llave Primaria y Llave Foránea
La integridad referencial es un principio clave en las bases de datos que garantiza que los datos
relacionados entre diferentes tablas sean consistentes y correctos. Para lograr esto, se utilizan
dos elementos fundamentales: la llave primaria y la llave foránea.
La llave primaria es un identificador único en una tabla que permite diferenciar cada registro.
Por ejemplo, en una tabla de clientes, el número de identificación de cada cliente podría ser la
llave primaria. Por otro lado, la llave foránea es un campo en una tabla que referencia la llave
primaria de otra tabla, creando una relación entre ellas.
Un ejemplo común es un sistema de ventas donde tenemos una tabla de "Clientes" con una
llave primaria llamada ID y otra tabla de "Pedidos" con una llave foránea ID, que indica qué
cliente realizó cada pedido. Esto asegura que los pedidos estén correctamente asociados a los
clientes y evita errores como asignar un pedido a un cliente inexistente.

Llave Primaria y Llave Foránea

DIFERENCIAS ENTRE LOS DISTINTOS TIPOS DE JOIN


Cuando queremos combinar datos de varias tablas, usamos diferentes tipos de
combinaciones llamadas JOINs. Dependiendo de la información que necesitemos, elegimos
una de estas opciones:
• INNER JOIN: Devuelve solo los registros que tienen coincidencias en ambas tablas.
3

• LEFT JOIN: Devuelve todos los registros de la tabla izquierda y solo los coincidentes de
Página

la tabla derecha.
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 03

• RIGHT JOIN: Devuelve todos los registros de la tabla derecha y solo los coincidentes
de la tabla izquierda.
• FULL OUTER JOIN: Devuelve todos los registros de ambas tablas, combinando la
información disponible.

Diferencias entre JOIN

Por ejemplo, si queremos conocer qué empleados han realizado ventas en una tienda,
podemos usar un INNER JOIN entre la tabla de empleados y la de ventas. Si queremos una lista
de todos los empleados, incluyendo aquellos que no han hecho ventas, usaríamos un LEFT
JOIN.

"La integridad referencial en bases de datos garantiza la


consistencia de los datos mediante llaves primarias y foráneas,
permitiendo relaciones seguras entre tablas y evitando errores en la
asociación de registros."

APLICACIÓN DE SENTENCIAS JOIN EN SQL


Para aplicar estos conceptos en SQL, se utilizan sentencias específicas. Un ejemplo de una
4

consulta que combina datos de una tabla de clientes con una tabla de pedidos sería:
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 03

SQL

Esta consulta muestra el nombre del cliente junto con la fecha y total de sus pedidos, siempre
y cuando haya una coincidencia en ambas tablas. Si quisiéramos incluir clientes sin pedidos,
podríamos usar un LEFT JOIN.

CONSULTA A TABLAS RELACIONADAS


Qué es un modelo de datos y cómo interpretarlo
Un modelo de datos es una representación estructurada de la información dentro de una base
de datos. Permite organizar los datos en tablas y definir cómo se relacionan entre sí. Existen
diferentes tipos de modelos, como el relacional, que se basa en tablas conectadas a través de
llaves primarias y foráneas.
Por ejemplo, en un sistema de biblioteca, podríamos tener un modelo de datos con tablas
como "Libros", "Usuarios" y "Préstamos", donde cada préstamo está relacionado con un
usuario y un libro específico.

Integridad referencial: Llaves Primarias y Foráneas


Como se mencionó antes, la integridad referencial es fundamental para mantener la
coherencia en una base de datos. La combinación de llaves primarias y foráneas permite que
los datos se mantengan organizados y que las relaciones entre tablas sean correctas.
Si tenemos una tabla de "Pacientes" en un hospital con una llave primaria id_paciente, y una
tabla de "Consultas Médicas" con una llave foránea id_paciente, aseguramos que cada
consulta esté correctamente asignada a un paciente registrado.

"Las sentencias JOIN en SQL permiten combinar datos de múltiples


tablas mediante llaves primarias y foráneas, facilitando consultas
que relacionan información y garantizan la integridad referencial en
bases de datos."

Consultas de selección con tablas relacionadas


Las consultas de selección (SELECT) permiten extraer información específica de una base de
datos. Cuando se trabaja con tablas relacionadas, es necesario especificar cómo se conectan
los datos.
5

Por ejemplo, para obtener una lista de todos los productos vendidos en una tienda junto con el
Página

nombre de los clientes que los compraron, podemos hacer lo siguiente:


FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 03

SQL

COMBINACIÓN DE TABLAS: TIPOS DE JOIN


Los distintos tipos de JOIN permiten obtener información combinada de varias tablas según
las necesidades. Usar el tipo correcto de JOIN garantiza que se muestren los datos adecuados.

TABLA RESUMEN – Combinar Tablas


Tipo de JOIN Descripción
INNER JOIN Solo registros coincidentes en ambas tablas
LEFT JOIN Todos los registros de la tabla izquierda y coincidentes de la derecha
RIGHT JOIN Todos los registros de la tabla derecha y coincidentes de la izquierda
FULL JOIN Todos los registros de ambas tablas

6
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 04

Contenido
INTRODUCCIÓN ............................................................................................................. 1
DATOS AGRUPADOS EN LENGUAJE SQL .......................................................................... 2
CLÁUSULAS DE AGRUPACIÓN Y FUNCIONES DE AGREGACIÓN ....................................... 2
SENTENCIA HAVING EN CONSULTAS DE AGRUPACIÓN.................................................... 3
CONSULTAS AGRUPADAS................................................................................................ 3
Implementación de Funciones de Agregación ............................................................... 4
La Sentencia GROUP BY............................................................................................... 4
La Sentencia HAVING .................................................................................................. 4
TABLA RESUMEN – Datos agrupados en SQL .................................................................... 5

INTRODUCCIÓN

En la actualidad, las organizaciones generan grandes volúmenes de información en su día a


día. Desde datos de ventas hasta registros de clientes y operaciones internas, todo se
almacena en bases de datos. Sin embargo, para poder aprovechar esta información y
convertirla en conocimientos útiles, es necesario contar con herramientas que permitan
organizar y analizar los datos de manera eficiente. En este módulo, aprenderás a realizar
consultas agrupadas utilizando SQL, un lenguaje diseñado específicamente para interactuar
con bases de datos.
El análisis de datos no solo se trata de obtener información, sino también de presentarla de
manera ordenada para que pueda ser comprendida y utilizada para la toma de decisiones. Aquí
exploraremos cómo agrupar datos de acuerdo a diferentes criterios, cómo calcular valores
importantes como promedios y sumas, y cómo aplicar filtros avanzados para extraer solo la
información más relevante. Todo esto te permitirá transformar grandes cantidades de datos en
reportes claros y fáciles de interpretar.
Este módulo está diseñado para personas que están comenzando en el mundo del análisis de
datos y no requieren conocimientos previos en bases de datos. A través de explicaciones
sencillas y ejemplos prácticos, aprenderás a escribir consultas SQL para agrupar y analizar
información de manera efectiva. Al finalizar, serás capaz de obtener insights valiosos que
pueden ayudar a mejorar procesos y tomar mejores decisiones en cualquier organización.
1
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 04

DATOS AGRUPADOS EN LENGUAJE SQL


Para poder analizar información en una base de datos, es fundamental conocer la estructura y
sintaxis de SQL. Este lenguaje nos permite hacer consultas específicas para extraer los datos
que necesitamos, de manera ordenada y estructurada. Dentro de SQL, existen funciones de
agregación como SUM(), AVG(), MIN(), MAX() y COUNT(), que nos ayudan a resumir los datos
de manera útil y rápida.
Cuando se trabaja con datos, no siempre necesitamos ver cada registro de forma individual,
sino que a veces es más útil agruparlos por categorías. Por ejemplo, si queremos analizar las
ventas de una tienda, puede ser más práctico ver el total vendido por cada mes en lugar de ver
cada transacción por separado. Para hacer esto, utilizamos la cláusula GROUP BY, que nos
permite organizar los datos según los criterios que elijamos.
Ejemplo: Supongamos que tenemos una base de datos con información de ventas. Si
queremos saber cuánto ha vendido cada vendedor en total, podemos usar la siguiente
consulta:
SQL

Esto nos mostrará una lista con cada vendedor y el total de sus ventas, en lugar de mostrar
cada venta de manera individual.

"Las consultas agrupadas en SQL permiten organizar datos


mediante la cláusula GROUP BY y funciones de agregación como
SUM(), AVG(), MIN(), MAX() y COUNT(), facilitando el análisis de
información estructurada en bases de datos."

CLÁUSULAS DE AGRUPACIÓN Y FUNCIONES DE AGREGACIÓN


Cuando necesitamos obtener información resumida de una base de datos, las funciones de
agregación y las cláusulas de agrupación son herramientas clave. Las funciones de agregación
nos permiten realizar cálculos sobre conjuntos de datos, mientras que GROUP BY nos ayuda a
organizarlos de manera más comprensible.
Por ejemplo, si estamos analizando datos de clientes en una empresa, podemos usar COUNT()
para saber cuántos clientes han comprado un producto en particular, AVG() para calcular el
promedio de compra y MAX() para encontrar la mayor compra registrada. Todas estas
funciones nos ayudan a resumir grandes volúmenes de información de forma clara.
Ejemplo: Si queremos calcular el número total de ventas realizadas por cada sucursal de una
2

tienda, podemos usar la siguiente consulta:


Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 04

SQL

Esta consulta nos mostrará cuántas ventas ha registrado cada sucursal, permitiéndonos
identificar cuáles tienen más actividad y tomar decisiones basadas en esos datos.

SENTENCIA HAVING EN CONSULTAS DE AGRUPACIÓN


A veces, después de agrupar los datos, queremos aplicar filtros adicionales para enfocarnos
solo en la información más relevante. Aquí es donde entra la cláusula HAVING. A diferencia de
WHERE, que filtra registros individuales antes de agruparlos, HAVING nos permite filtrar datos
después de que ya han sido agrupados.
Por ejemplo, si hemos agrupado las ventas por vendedor y queremos ver solo aquellos que han
vendido más de $10,000 en total, usamos HAVING. Esto nos permite centrarnos en los
vendedores con mejor desempeño sin necesidad de examinar cada venta individualmente.
Ejemplo: Si queremos ver solo los productos que han vendido más de 500 unidades, podemos
hacer la siguiente consulta:
SQL

Esta consulta nos muestra únicamente los productos más vendidos, filtrando aquellos que no
alcanzan el umbral de 500 unidades.

CONSULTAS AGRUPADAS
Las consultas agrupadas nos permiten organizar la información en una base de datos y
analizarla de manera más efectiva. En lugar de trabajar con cada registro de manera individual,
agrupamos datos similares para obtener resúmenes útiles.
Ejemplo: Si queremos conocer el promedio de edad de los clientes por ciudad, podemos
escribir:
SQL
3
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 04

Esto nos dará un listado con cada ciudad y la edad promedio de los clientes en cada una.

Implementación de Funciones de Agregación


Las funciones de agregación nos ayudan a obtener valores resumen de los datos.
• MIN() y MAX(): Nos permiten encontrar el valor más pequeño y más grande en un
conjunto de datos.
• AVG(): Calcula el promedio de un conjunto de valores.
• COUNT(): Cuenta cuántos registros hay en un conjunto de datos.
Ejemplo: Para saber el precio más alto y más bajo de una lista de productos:
SQL

Esto nos dirá cuál es el producto más barato y cuál es el más caro.

La Sentencia GROUP BY
La cláusula GROUP BY se usa para agrupar filas que tienen valores en común en una o más
columnas. Esto es útil cuando queremos hacer resúmenes de datos en lugar de ver cada
registro individualmente.
Ejemplo: Si queremos saber cuántos empleados hay en cada departamento:
SQL

Esto mostrará una lista con cada departamento y el número de empleados que trabajan en él.

"Las funciones de agregación en SQL, junto con GROUP BY y


HAVING, permiten resumir y filtrar datos agrupados, facilitando el
análisis de grandes volúmenes de información en bases de datos."

La Sentencia HAVING
Cuando aplicamos GROUP BY, a veces queremos filtrar los resultados basándonos en los
4
Página

valores agregados. HAVING nos permite hacer esto.


FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 04

Ejemplo: Si queremos ver solo los clientes que han gastado más de $500 en total:
SQL

Esto mostrará solo los clientes que han gastado más de $500 en total en la tienda.

TABLA RESUMEN – Datos agrupados en SQL

Concepto Descripción

Consultas agrupadas Permiten organizar y resumir datos en una base de datos.


Funciones de MIN(), MAX(), AVG(), COUNT() para calcular valores
agregación importantes.
Group By Agrupa los datos según criterios específicos.

Having Filtra los resultados después de la agrupación.

5
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 05

Contenido
INTRODUCCIÓN ............................................................................................................. 1
SUBQUERIES PARA LA OBTENCIÓN O MODIFICACIÓN DE DATOS .................................... 2
CONSULTAS ANIDADAS PARA LA OBTENCIÓN O MODIFICACIÓN DE DATOS ..................... 3
CONSULTAS ANIDADAS................................................................................................... 3
Proceso de evaluación de SubQueries .......................................................................... 3
Reglas asociadas a la implementación de SubQueries .................................................. 4
Utilización de SubQueries ............................................................................................ 4
TABLA RESUMEN - SubQuerys ......................................................................................... 5

INTRODUCCIÓN
En el mundo actual, los datos juegan un papel clave en la toma de decisiones dentro de las
organizaciones. Sin embargo, para aprovechar su verdadero valor, es necesario saber cómo
almacenarlos, recuperarlos y analizarlos de manera eficiente. Aquí es donde entran en juego
las bases de datos y, en particular, el lenguaje SQL (Structured Query Language), una
herramienta esencial para los analistas de datos. En este módulo, exploraremos cómo utilizar
consultas anidadas en SQL para obtener y modificar información de manera eficiente.
Las consultas anidadas, o SubQueries, permiten realizar búsquedas dentro de otras
consultas, facilitando la obtención de información específica sin necesidad de realizar
múltiples pasos manuales. Esta técnica es fundamental cuando se necesita extraer datos
complejos, combinar información de diferentes tablas o aplicar condiciones avanzadas dentro
de una misma consulta. A través de este módulo, aprenderemos cuándo y cómo utilizar
SubQueries para optimizar nuestro trabajo con bases de datos.

1
Página

Consultas anidadas - Esquema


FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 05

Al finalizar este módulo, serás capaz de reconocer en qué situaciones conviene utilizar
consultas anidadas, cómo aplicarlas en la práctica y cuáles son las reglas básicas para su
implementación. Todo esto te permitirá manejar mejor los datos disponibles en una
organización y generar insights que apoyen la toma de decisiones basada en información.

SUBQUERIES PARA LA OBTENCIÓN O MODIFICACIÓN DE DATOS


Las consultas anidadas son especialmente útiles cuando es necesario obtener información de
una tabla basada en los datos de otra. Por ejemplo, si queremos encontrar los empleados con
salarios por encima del promedio, una SubQuery nos permite calcular el salario promedio y
compararlo dentro de la misma consulta. De esta manera, evitamos realizar múltiples pasos
manuales y optimizamos la ejecución de la consulta.

"Las consultas anidadas en SQL permiten obtener, comparar y


modificar datos de manera eficiente dentro de una misma
consulta, optimizando el análisis y la gestión de información en
bases de datos."

Otro caso de uso común es la búsqueda de registros inexistentes en una tabla basándonos en
otra. Por ejemplo, si queremos identificar clientes que no han realizado compras en el último
mes, podemos utilizar una SubQuery para filtrar aquellos que no tienen registros recientes en
la tabla de transacciones. Esto es clave para estrategias de fidelización y retención de clientes.
Finalmente, las SubQueries pueden ser utilizadas para realizar modificaciones en los datos. Si
una empresa desea actualizar los precios de ciertos productos basándose en el promedio de
ventas de los últimos tres meses, se puede utilizar una SubQuery para calcular ese promedio
y aplicarlo a los registros correspondientes en la base de datos.

Ejemplo SubQuery - UPDATE


2
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 05

CONSULTAS ANIDADAS PARA LA OBTENCIÓN O MODIFICACIÓN


DE DATOS
Para construir una consulta anidada efectiva, es fundamental comprender la estructura de la
base de datos y la relación entre sus tablas. En primer lugar, se debe identificar la información
que se desea obtener y la condición que debe cumplir. Luego, se diseña la SubQuery que
permitirá extraer estos datos y utilizarlos dentro de la consulta principal.
Por ejemplo, si queremos listar los productos más vendidos en el último trimestre, primero se
debe crear una SubQuery que calcule el total de ventas por producto en ese período.
Posteriormente, se usa esta información dentro de una consulta principal que seleccione los
productos con mayor volumen de ventas. Esta metodología permite generar reportes
dinámicos y de gran valor para la empresa.
En el caso de la modificación de datos, podemos usar SubQueries para actualizar registros
específicos. Si una empresa desea ajustar los descuentos en función del nivel de compras de
sus clientes, se puede diseñar una SubQuery que determine el promedio de compras de cada
cliente y luego usarlo en una consulta principal para modificar los valores en la base de datos.

CONSULTAS ANIDADAS
Las consultas anidadas, también conocidas como SubQueries, son consultas SQL dentro de
otra consulta más grande. Se utilizan para realizar filtrados complejos, calcular valores
específicos o generar resultados intermedios que facilitan la consulta principal. Su uso es
clave para optimizar la extracción de datos en bases de datos grandes y mejorar la eficiencia
en el análisis.

Ejemplo: Si queremos obtener una lista de clientes cuyo gasto total supera el gasto promedio
de todos los clientes, podríamos usar la siguiente consulta anidada:
SQL

Esta SubQuery calcula el promedio de gasto y la consulta principal filtra aquellos clientes que
están por encima de este umbral.

Proceso de evaluación de SubQueries


Cuando se ejecuta una consulta anidada, la base de datos primero resuelve la SubQuery y
luego usa el resultado en la consulta principal. Este proceso es fundamental para entender
cómo funciona la lógica de SQL y evitar errores al estructurar nuestras consultas.
Ejemplo: Si queremos listar los productos que tienen un precio mayor al precio promedio, el
proceso de evaluación es el siguiente:
1. Se ejecuta la SubQuery para calcular el precio promedio.
3

2. Se usa ese valor en la consulta principal para filtrar los productos.


Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 05

Reglas asociadas a la implementación de SubQueries


Para que una SubQuery funcione correctamente, debe cumplir ciertas reglas:
• Debe estar entre paréntesis dentro de la consulta principal.
• Debe devolver un solo valor cuando se usa en comparaciones (=, >, <, etc.).
• Puede devolver múltiples valores cuando se usa con IN o EXISTS.

Ejemplo: Si queremos encontrar a los empleados que trabajan en los mismos departamentos
que los empleados con más de 10 años de antigüedad:
SQL

Las consultas anidadas en SQL permiten filtrar, calcular y modificar


datos dentro de una consulta principal, optimizando el análisis,
mejorando la eficiencia y facilitando la recuperación de información
en bases de datos relacionales.

Utilización de SubQueries
Las SubQueries son recomendables cuando:
• Necesitamos un resultado intermedio dentro de una consulta más grande.
• Queremos evitar múltiples consultas separadas y combinar la lógica en una sola
instrucción SQL.
• Trabajamos con bases de datos grandes y queremos optimizar la recuperación de
datos sin afectar el rendimiento.

Ejemplo: Si una empresa desea identificar clientes VIP que han gastado más de cierto umbral
en compras en los últimos seis meses, una SubQuery puede calcular el gasto total de cada
cliente y luego filtrar aquellos que superen el umbral definido.

4
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 05

TABLA RESUMEN - SubQuerys

Tema Descripción
Uso de SubQueries para optimizar la recuperación de
Consultas anidadas
datos
Proceso de evaluación de
Cómo SQL ejecuta y resuelve consultas anidadas
SubQueries
Normas y restricciones para la implementación de
Reglas para SubQueries
SubQueries
Cuándo utilizarlas Situaciones en las que las SubQueries son más útiles

5
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

Contenido
INTRODUCCIÓN ............................................................................................................. 1
CREACIÓN DE UNA TABLA CON COLUMNAS Y TIPOS DE DATOS....................................... 2
INSERCIÓN DE DATOS EN UNA TABLA - SENTENCIA INSERT ............................................. 3
ELIMINACIÓN DE DATOS EN UNA TABLA - SENTENCIA DELETE ......................................... 3
ACTUALIZACIÓN DE DATOS EN UNA TABLA - SENTENCIA UPDATE .................................... 3
CREACIÓN Y MANIPULACIÓN DE TABLAS ........................................................................ 4
Creación de una tabla .................................................................................................. 4
Definición de columnas y tipos de datos ....................................................................... 4
Tipos de Datos Numéricos ........................................................................................... 4
Tipos de Datos de Texto o Cadenas de Caracteres......................................................... 5
Tipos de Datos de Fecha y Hora .................................................................................... 7
Tipos de Datos Booleanos ............................................................................................ 7
Tipos de Datos Especiales............................................................................................ 8
RECOMENDACIONES AL MANIPULAR BDD ...................................................................... 8
Restricciones y especificaciones en las columnas ........................................................ 8
Inserción manual de valores en una tabla ..................................................................... 8
Actualización de valores existentes en una tabla........................................................... 8
Eliminación de registros específicos en una tabla ......................................................... 8
Consideraciones sobre el peligro de eliminar registros .................................................. 8
TABLA RESUMEN – Sentencias SQL.................................................................................. 9

INTRODUCCIÓN

En la actualidad, la información es un recurso clave en cualquier organización. Sin embargo,


para que estos datos sean útiles, deben estar bien organizados y estructurados dentro de
bases de datos. Este módulo introduce a los participantes en el uso del lenguaje SQL, una
herramienta fundamental para la manipulación y consulta de datos en bases de datos
relacionales. A través de este conocimiento, podrán extraer información valiosa para la toma
de decisiones.
Aprender a manejar bases de datos es un paso esencial para cualquier persona interesada en
el análisis de datos. No es necesario ser un programador o un experto en informática para
utilizar SQL de manera efectiva. Con una comprensión clara de sus principios básicos,
cualquier persona puede acceder, modificar y analizar información almacenada en bases de
1

datos, lo que resulta clave en diversas industrias como el comercio, la banca, la salud y la
Página

manufactura.
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

A lo largo de este módulo, los participantes aprenderán a crear tablas, definir sus estructuras
y manipular información mediante la inserción, actualización y eliminación de datos. Además,
explorarán las consideraciones clave a la hora de gestionar la información para evitar errores y
pérdidas de datos. Con estas habilidades, estarán preparados para resolver problemáticas
reales de manipulación de información dentro de sus organizaciones.

CREACIÓN DE UNA TABLA CON COLUMNAS Y TIPOS DE DATOS


Las bases de datos almacenan información en estructuras llamadas tablas, que pueden ser
vistas como hojas de cálculo organizadas con filas y columnas. Cada columna representa un
tipo específico de dato, como nombres, fechas o cantidades, y su correcta definición es
fundamental para garantizar que la información ingresada sea precisa y útil.
Por ejemplo, si una empresa necesita registrar la información de sus clientes, podría crear una
tabla llamada Clientes, donde cada columna represente un dato relevante, como el nombre
del cliente (texto), su edad (número) y la fecha de registro (fecha). Elegir los tipos de datos
correctos evita errores, como ingresar una palabra en una columna donde solo deberían ir
números.

" SQL permite organizar, estructurar y manipular datos en bases de


datos relacionales, facilitando la extracción y análisis de
información para la toma de decisiones en diversas industrias."

Definir correctamente la estructura de una tabla desde el inicio facilita la manipulación


posterior de la información y asegura que el análisis de los datos sea confiable. Además, las
bases de datos permiten agregar reglas o restricciones para evitar inconsistencias, como evitar
que un cliente tenga dos identificaciones iguales.

2
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

INSERCIÓN DE DATOS EN UNA TABLA - SENTENCIA INSERT


Una vez que la estructura de una tabla está definida, el siguiente paso es agregar información.
Esto se realiza con la instrucción INSERT INTO, que permite ingresar nuevos registros en la base
de datos de forma organizada.
Por ejemplo, supongamos que tenemos una tabla llamada Ventas donde queremos registrar
compras de clientes. Un analista de datos puede insertar un nuevo registro con información
como el ID del cliente, el producto adquirido y el monto de la compra. La sentencia SQL sería
algo como:
SQL

Este comando agrega una nueva fila a la tabla Ventas con los valores específicos. La inserción
de datos es un proceso fundamental porque permite mantener un registro estructurado de la
información que luego se analizará para tomar decisiones.

ELIMINACIÓN DE DATOS EN UNA TABLA - SENTENCIA DELETE


En ocasiones, es necesario eliminar información de una base de datos, ya sea porque se
ingresó erróneamente o porque ya no es relevante. Para esto se utiliza la instrucción DELETE,
que permite eliminar registros específicos de una tabla.
Por ejemplo, si un cliente solicita la eliminación de su historial de compras por razones de
privacidad, el analista puede ejecutar un comando como:
SQL

Este comando borra todas las compras asociadas al cliente con ID 1. Sin embargo, se debe
tener cuidado con esta acción, ya que si se ejecuta sin una condición (WHERE), eliminaría
todos los registros de la tabla, lo que podría causar la pérdida irreversible de información
valiosa.

ACTUALIZACIÓN DE DATOS EN UNA TABLA - SENTENCIA UPDATE


La información en una base de datos puede cambiar con el tiempo, por lo que es necesario
actualizar ciertos valores sin eliminar ni volver a insertar datos. Para esto se usa la instrucción
UPDATE, que permite modificar registros específicos dentro de una tabla.
Por ejemplo, si un cliente cambia su dirección, en lugar de eliminar y volver a ingresar su
información, un analista de datos puede actualizar solo el campo necesario con un comando
como:
3
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

SQL

Este comando actualiza la dirección del cliente con ID 1 sin afectar el resto de la información.
Usar correctamente UPDATE permite mantener la base de datos actualizada sin comprometer
su integridad.

“SQL permite insertar, eliminar y actualizar datos en bases de datos


mediante las sentencias INSERT, DELETE y UPDATE, asegurando la
correcta gestión y mantenimiento de la información.”

CREACIÓN Y MANIPULACIÓN DE TABLAS


Creación de una tabla
Las bases de datos almacenan la información en tablas, que deben crearse con una estructura
definida de antemano. Una tabla se define especificando su nombre, columnas y los tipos de
datos que contendrá cada una. Esto es fundamental porque una buena estructura facilita la
consulta y manipulación de los datos.

Definición de columnas y tipos de datos


Cada columna de una tabla tiene un propósito específico y debe contener un tipo de dato
adecuado. Por ejemplo, una columna de nombres debe almacenar solo texto, mientras que
una columna de fechas debe aceptar solo valores de fecha. Definir correctamente estos tipos
evita errores al procesar la información.

Tipos de Datos Numéricos


Los datos numéricos se utilizan para almacenar valores matemáticos, como precios,
cantidades o identificadores. Se dividen en números enteros y números decimales.

Números Enteros
Estos valores no tienen decimales y se utilizan cuando solo necesitamos representar
cantidades exactas. Algunos ejemplos incluyen:
• TINYINT: Almacena números pequeños (de -128 a 127).
• SMALLINT: Almacena valores más grandes (de -32,768 a 32,767).
• INT (INTEGER): Es el tipo más común, que almacena valores enteros de gran tamaño
4
Página

(de -2,147,483,648 a 2,147,483,647).


FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

• BIGINT: Se usa cuando se necesitan números extremadamente grandes (útil para


identificadores únicos en bases de datos con millones de registros).
Ejemplo: Si estamos almacenando edades en una base de datos de empleados, la mejor
opción sería un TINYINT, ya que los valores estarán entre 0 y 120.
SQL

Números Decimales
Estos valores incluyen decimales y se usan cuando se necesita precisión en cálculos
financieros o mediciones. Algunos tipos incluyen:
• FLOAT: Guarda números con decimales, pero con menor precisión.
• DOUBLE: Similar a FLOAT, pero con mayor precisión.
• DECIMAL (NUMERIC): Se usa cuando se necesita precisión exacta, como en cálculos
monetarios.
Ejemplo: Si estamos manejando precios de productos en una tienda, usar DECIMAL(10,2) es
ideal porque permite representar precios con dos decimales.
SQL

Tipos de Datos de Texto o Cadenas de Caracteres


Estos tipos de datos almacenan texto, como nombres, descripciones o direcciones. Se dividen
en:

Cadenas de Longitud Fija


• CHAR(n): Almacena una cantidad fija de caracteres. Si la cadena tiene menos
caracteres, se completa con espacios. Se usa cuando el tamaño del dato es siempre
el mismo (por ejemplo, códigos de productos o siglas de países).
5
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

Ejemplo:
SQL

“SQL permite crear y manipular tablas definiendo tipos de datos


adecuados como numéricos, texto, fechas y booleanos,
asegurando la correcta estructuración y eficiencia en la gestión de
la información.”

Cadenas de Longitud Variable


• VARCHAR(n): Almacena texto de longitud variable hasta un máximo definido. Es más
flexible y eficiente que CHAR, porque solo ocupa el espacio que necesita.

Ejemplo:
SQL

Cadenas de Texto Extensas


• TEXT: Se usa para almacenar grandes volúmenes de texto, como descripciones largas,
comentarios o artículos.
Ejemplo:
SQL
6
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

Tipos de Datos de Fecha y Hora


Estos tipos permiten almacenar información relacionada con fechas y tiempos, lo que es
fundamental en registros de transacciones, eventos o historiales.
• DATE: Almacena solo la fecha (formato YYYY-MM-DD).
• TIME: Almacena solo la hora (formato HH:MM:SS).
• DATETIME: Almacena fecha y hora combinadas.
• TIMESTAMP: Similar a DATETIME, pero ajustado a zonas horarias y útil para auditar
cambios en los datos.
Ejemplo: Si queremos almacenar la fecha de ingreso de empleados, usamos DATE:
SQL

Si necesitamos registrar la fecha y hora exacta de una compra:


SQL

Tipos de Datos Booleanos


El tipo BOOLEAN almacena valores verdadero (TRUE) o falso (FALSE). Aunque SQL estándar
no lo incluye directamente, en muchas bases de datos se representa con TINYINT(1) (0 para
falso, 1 para verdadero).
Ejemplo: Si queremos registrar si un cliente está activo o no, usamos un campo booleano:
SQL
7
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

Tipos de Datos Especiales


Algunas bases de datos admiten tipos de datos especializados, como:
• JSON: Almacena datos en formato JSON, útil para aplicaciones web que manejan
información estructurada.
• XML: Para almacenar datos en formato XML.
• BLOB: Para almacenar archivos como imágenes o documentos.
Ejemplo de JSON:
SQL

RECOMENDACIONES AL MANIPULAR BDD


Restricciones y especificaciones en las columnas
Para asegurar la integridad de los datos, las bases de datos permiten agregar restricciones,
como establecer claves primarias, evitar valores duplicados o requerir que ciertos campos no
queden vacíos. Estas reglas mejoran la confiabilidad de la información almacenada.

Inserción manual de valores en una tabla


El ingreso de información en una base de datos se realiza con la sentencia INSERT, que permite
agregar registros de manera estructurada. Esto es útil cuando se necesita registrar
transacciones, ventas o cualquier otro tipo de información relevante.

Actualización de valores existentes en una tabla


Si la información en una base de datos cambia, es posible modificarla sin necesidad de
eliminar y volver a ingresar los datos. La sentencia UPDATE permite cambiar valores
específicos en función de una condición determinada.

Eliminación de registros específicos en una tabla


La eliminación de información es una acción delicada que se debe realizar con precaución. La
sentencia DELETE permite borrar registros de manera controlada, asegurando que solo se
eliminen los datos necesarios.

Consideraciones sobre el peligro de eliminar registros


Eliminar información sin restricciones puede llevar a la pérdida de datos importantes. Para
evitar esto, se recomienda siempre incluir una condición en la sentencia DELETE y realizar
copias de seguridad antes de eliminar información crítica.
8
Página
FUNDAMENTOS DE ANÁLISIS DE DATOS – Módulo 7 Sesión 06

TABLA RESUMEN – Sentencias SQL

Concepto Descripción
Creación de una tabla Definir estructura de datos en una base de datos
Definición de columnas y tipos de Especificar los datos que almacenará cada
datos columna
Restricciones en columnas Reglas para evitar errores y duplicaciones

Inserción de datos Agregar registros a una tabla utilizando SQL

Actualización de datos Modificar valores existentes en una tabla

Eliminación de registros Borrar datos de manera controlada

Consideraciones sobre eliminación Precauciones para evitar la pérdida de datos

9
Página

También podría gustarte