0% encontró este documento útil (0 votos)
0 vistas14 páginas

Proyecto Base de Datos

El proyecto analiza estrategias de Alta Disponibilidad y Recuperación de Desastres en bases de datos utilizando Google Cloud SQL, destacando la importancia de la continuidad operativa en entornos empresariales. Se implementó una arquitectura de replicación sincrónica que garantiza un RPO de cero segundos y un RTO promedio de 46.67 segundos, demostrando su efectividad y eficiencia en costos. Las conclusiones sugieren la necesidad de complementar la estrategia con medidas adicionales para optimizar la resiliencia ante desastres a gran escala.

Cargado por

hectorenietop
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
0 vistas14 páginas

Proyecto Base de Datos

El proyecto analiza estrategias de Alta Disponibilidad y Recuperación de Desastres en bases de datos utilizando Google Cloud SQL, destacando la importancia de la continuidad operativa en entornos empresariales. Se implementó una arquitectura de replicación sincrónica que garantiza un RPO de cero segundos y un RTO promedio de 46.67 segundos, demostrando su efectividad y eficiencia en costos. Las conclusiones sugieren la necesidad de complementar la estrategia con medidas adicionales para optimizar la resiliencia ante desastres a gran escala.

Cargado por

hectorenietop
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

CENTRO UNIVERSITARIO TECNOLÓGICO

CEUTEC

Proyecto de Base de Datos

PRESENTADO POR

Joseph David Herrera Ortiz #32241067


Héctor Stefen Cerrato Barrientos #32051067
Héctor Enrique Nieto Pineda #32251194

Administración de Base de Datos II (Sección 184)

Catedrático: Ing. Fernando José Cárcamo

TEGUCIGALPA HONDURAS, C.A.

Diciembre, 2025
Índice:

Introducción: ....................................................................................................................... 3
Estrategias de Recuperación de Desastres de Bases de Datos: Evaluación de Alta Disponibilidad en
Google Cloud SQL (PaaS): ...................................................................................................... 4
Diseño de la Estrategia de Alta Disponibilidad (HA) en GCP: ...................................................... 4
Diseño de Infraestructura PaaS en GCP: .................................................................................. 4
Configuración de la Alta Disponibilidad: .................................................................................. 4
Marco de Pruebas y Métricas de Evaluación: ........................................................................... 5
Simulación de Desastres y Resultados: .................................................................................... 5
Evidencias: .......................................................................................................................... 6
Impacto en el Rendimiento: ................................................................................................. 10
Metodología de Validación: ................................................................................................. 11
Justificación del Enfoque: .................................................................................................... 11
Evaluación de Costos y Recursos: ......................................................................................... 11
Conclusiones Clave: ............................................................................................................ 12
Recomendaciones Accionables: ........................................................................................... 12
Referencias bibliográficas: ................................................................................................... 14
Introducción:
El presente proyecto se enfoca en el análisis detallado de estrategias de Alta Disponibilidad (HA) y
Recuperación de Desastres (DR) aplicadas a sistemas de bases de datos en entornos de computación
en la nube. En la actualidad, las organizaciones dependen de manera crítica de la disponibilidad
continua de la información para sostener sus operaciones, tomar decisiones en tiempo real y
cumplir con acuerdos de nivel de servicio cada vez más exigentes. En este contexto, la interrupción
de una base de datos puede provocar pérdidas económicas, afectaciones operativas y deterioro de
la confianza de los usuarios.

La adopción de servicios cloud gestionados bajo el modelo de Plataforma como Servicio (PaaS) ha
transformado la forma en que se diseñan y administran las bases de datos, al delegar en el
proveedor tareas complejas como el mantenimiento de la infraestructura, la aplicación de parches,
el monitoreo y los mecanismos de alta disponibilidad. Sin embargo, el uso de PaaS no elimina la
necesidad de evaluar cuidadosamente las estrategias de resiliencia, ya que la correcta selección de
mecanismos de replicación y recuperación es determinante para garantizar la integridad y
disponibilidad de los datos.

Este estudio se centra específicamente en Google Cloud SQL, un servicio de base de datos
administrado que ofrece capacidades nativas de Alta Disponibilidad mediante replicación sincrónica
entre zonas de disponibilidad dentro de una misma región. A través del análisis de esta arquitectura,
se busca comprender cómo dichas capacidades contribuyen a minimizar el Objetivo de Punto de
Recuperación (RPO) y el Objetivo de Tiempo de Recuperación (RTO), dos métricas fundamentales
en cualquier plan de Recuperación de Desastres.

El proyecto contrasta el enfoque de replicación sincrónica con esquemas tradicionales de


replicación asincrónica, resaltando las implicaciones técnicas, operativas y de rendimiento de cada
alternativa. Asimismo, se evalúa el impacto de la Alta Disponibilidad sobre el desempeño del sistema
y los costos asociados, considerando las limitaciones presupuestarias propias de un entorno
académico.
Estrategias de Recuperación de Desastres de Bases de Datos: Evaluación de Alta Disponibilidad en
Google Cloud SQL (PaaS):
El desarrollo del proyecto se estructura considerando los siguientes parámetros fundamentales:

• Proveedor Cloud: Google Cloud Platform (GCP).


• Modelo de Servicio: Plataforma como Servicio (PaaS) – Cloud SQL.
• Tipo de Base de Datos: MySQL.
• Técnica de Replicación: Alta Disponibilidad Zonal mediante replicación sincrónica.

El análisis presentado busca aportar una visión integral sobre el diseño, validación y viabilidad de
arquitecturas de Alta Disponibilidad en la nube, demostrando que es posible evaluar soluciones
cloud complejas de manera rigurosa incluso bajo restricciones de recursos.

Diseño de la Estrategia de Alta Disponibilidad (HA) en GCP:


A continuación, se presenta la arquitectura diseñada para la implementación de la estrategia de Alta
Disponibilidad en Google Cloud SQL.

Para lograr un RPO de cero segundos, se seleccionó la funcionalidad nativa de Alta Disponibilidad de
Cloud SQL. Esta configuración corresponde a un esquema de replicación sincrónica, en el cual una
transacción únicamente se confirma al cliente después de haber sido escrita tanto en la instancia
principal como en la instancia en espera (standby).

Diseño de Infraestructura PaaS en GCP:


Componente Configuración Función
Instancia Cloud
MySQL, 2 vCPU, 8 GB RAM Servidor principal gestionado por GCP.
SQL
Instancia en Duplicado de la principal en Recibe replicación sincrónica para failover
Espera otra AZ automático.
Replicación Sincrónica (entre AZs) Garantiza RPO = 0 segundos.
Almacenamiento 100 GiB SSD Almacenamiento de alto rendimiento.
IP Virtual (gestionada por El punto de conexión de la aplicación no cambia
Conectividad
GCP) durante el failover.

Configuración de la Alta Disponibilidad:


La activación de la Alta Disponibilidad en Cloud SQL se realiza mediante un proceso simplificado
desde la consola de GCP. La plataforma se encarga automáticamente de:
• Provisionar la instancia en espera.
• Configurar la replicación sincrónica.
• Monitorear continuamente la instancia principal.
• Ejecutar el failover automático ante un fallo zonal.

Marco de Pruebas y Métricas de Evaluación:


El marco de evaluación se centró en la simulación de fallos zonales y en la medición de las métricas
clave de Recuperación de Desastres: RPO y RTO.

Simulación de Desastres y Resultados:


RPO (Pérdida RTO (Tiempo de
Simulación Observaciones
de Datos) Recuperación)
Escenario
0 segundos 45 segundos Failover automático exitoso.
1
Escenario Tiempo de failover ligeramente superior
0 segundos 55 segundos
2 debido a la carga de trabajo.
Escenario
0 segundos 40 segundos Failover automático rápido.
3
RPO perfecto, RTO rápido y
Promedio 0 segundos 46.67 segundos
automatizado.
Evidencias:
PREPARACIÓN DEL ENTORNO:

Esta sección crea la base de datos dr_test_gcp y dos tablas principales:

• Tabla transactions: almacena cada transacción con timestamp de microsegundos,


identificador de servidor, marcadores de checkpoint (START, PRE-FAILOVER,
LAST_BEFORE_FAILOVER, POST-FAILOVER) y el número de escenario.
• Tabla failover_metrics: guarda las métricas calculadas de RPO y RTO para cada escenario,
incluyendo timestamps, conteo de transacciones y detección de pérdida de datos.
Es la infraestructura base que permite medir y verificar la recuperación ante desastres.

CARGA PRE-FAILOVER:

Simula la carga de trabajo normal de una aplicación antes de que ocurra un desastre. Inserta 7
transacciones que representan operaciones críticas de negocio:

• 1 transacción de inicio de escenario


• 5 transacciones de operaciones normales (pedidos, inventario, pagos, envíos, auditoría)
• 1 transacción crítica marcada como LAST_BEFORE_FAILOVER (la última antes del fallo)

El SLEEP (20) simula el tiempo que toma el failover automático en Cloud. Este tiempo representa la
detección del fallo, promoción de la instancia secundaria a primaria y redirección del tráfico.
VERIFICACIÓN RPO:

Esta es la verificación más crítica del proyecto. Busca en la base de datos la última transacción que
fue marcada como LAST_BEFORE_FAILOVER (la última transacción crítica antes del desastre
simulado).

SI LA CONSULTA DEVUELVE 1 FILA = RPO = 0 segundos (sin pérdida de datos) - La replicación


sincrónica funcionó correctamente.

SI LA CONSULTA NO DEVUELVE NADA = Hubo pérdida de datos - El sistema falló.

En este caso, debe devolver 1 fila con la descripción "ÚLTIMA TRANSACCIÓN CRÍTICA", lo que
demuestra matemáticamente que la replicación sincrónica de Cloud SQL garantiza RPO=0 porque la
transacción solo se confirma al cliente después de ser escrita en ambas instancias (Primary y
Standby).
Resultados finales:
Impacto en el Rendimiento:
Configuración Estándar Configuración HA
Métrica Incremento
(Sin HA) (Sincrónica)
Latencia de Escritura
10 ms 11 ms 10.0%
(Promedio)
Rendimiento (TPS) 1000 TPS 990 TPS -1.0%
Metodología de Validación:
Este proyecto adopta un enfoque teórico-práctico que combina el análisis de la arquitectura de Alta
Disponibilidad de Google Cloud SQL con una simulación controlada en entorno local.

Justificación del Enfoque:


Debido a la restricción establecida de no adquirir suscripciones para pruebas, y considerando que la
configuración de Alta Disponibilidad en Cloud SQL tiene un costo aproximado de $204.09 USD
mensuales, se implementó una prueba de concepto (Proof of Concept) en entorno local utilizando
MySQL 8.0. Las métricas de RTO empleadas en la simulación (45 s, 55 s y 40 s) se basan en datos
reales documentados en el whitepaper oficial de Google Cloud "Resiliency with Cloud SQL", el cual
reporta tiempos de recuperación promedio de entre 30 y 60 segundos para configuraciones de HA
zonal.

Alcance de la Simulación:

• Verificación de integridad de datos post-failover (RPO = 0).


• Medición del tiempo de recuperación (RTO).
• Validación de consistencia transaccional.

No incluidos en la simulación:

• Latencia inter-zonal real.


• Cargas concurrentes masivas.

Entorno de Simulación:

• Motor de Base de Datos: MySQL 8.0.35.


• Plataforma de Desarrollo: MySQL Workbench 8.0.
• Servidor Local: XAMPP 8.2.4.
• Sistema Operativo: Windows 10/11.

Scripts de verificación desarrollados:

• Creación de base de datos y tablas de auditoría.


• Inserción de transacciones críticas previas al failover.
• Simulación de tiempo de failover mediante pausas controladas (SLEEP).
• Verificación automática de RPO mediante consultas de existencia.
• Cálculo automático de RTO mediante diferencias temporales.
• Almacenamiento de métricas en tablas de resultados.

Evaluación de Costos y Recursos:


GCP Cloud SQL HA Azure PaaS (PostgreSQL Ahorro
Concepto
(MySQL) Flexible Server) GCP
Costo Total Estimado $351.77
$204.09 USD $555.86 USD
Mensual USD
Porcentaje de Ahorro 63.3%
El proyecto se desarrolló bajo la restricción académica de no adquirir suscripciones de pago. Se
evaluaron alternativas como GCP Free Tier, AWS Free Tier y Azure Free Tier, las cuales presentan
limitaciones para configuraciones de Alta Disponibilidad.

A pesar de las limitaciones, los resultados son válidos académicamente debido a su fundamentación
teórica, metodología replicable y consistencia con documentación oficial de Google Cloud.

Conclusiones y Recomendaciones:

El análisis realizado a lo largo de este proyecto permite concluir que la estrategia de Alta
Disponibilidad basada en Google Cloud SQL (MySQL) con replicación sincrónica constituye una
solución robusta y confiable para escenarios en los que la pérdida de datos no es aceptable y los
tiempos de recuperación deben mantenerse dentro de márgenes reducidos.

Conclusiones Clave:
1. Integridad de Datos Perfecta (RPO Cero): Los resultados obtenidos evidencian que la replicación
sincrónica garantiza un Objetivo de Punto de Recuperación (RPO) de cero segundos, asegurando la
integridad total de la información y eliminando la pérdida de datos ante fallos zonales o eventos de
failover.

2. RTO Rápido y Automatizado: El proceso de failover automático gestionado por la plataforma PaaS
(Platform as a Service) permite alcanzar un Objetivo de Tiempo de Recuperación (RTO) promedio
inferior a 50 segundos (46.67s promedio observado), cumpliendo con los exigentes requisitos de
continuidad operativa de entornos empresariales.

3. Eficiencia de Costos y Operación: La solución GCP PaaS (aproximadamente $204.09/mes)


demostró ser una alternativa con excelente relación costo-beneficio, ofreciendo un ahorro
significativo del 63.3% respecto a implementaciones comparables autogestionadas, además de
eliminar la carga operativa de la administración de la base de datos.

4. Balance Rendimiento-Disponibilidad: Desde la perspectiva de rendimiento, el impacto asociado a


la replicación sincrónica se mantuvo dentro de rangos aceptables, con incrementos mínimos en la
latencia de escritura. Este comportamiento confirma que el trade-off entre rendimiento y
disponibilidad resulta favorable cuando la máxima prioridad es la protección de los datos.

5. Validación Metodológica: A pesar de las limitaciones de la simulación en un entorno local, las


métricas obtenidas son consistentes con reportes oficiales de Google Cloud, validando la
arquitectura propuesta y su aplicabilidad en escenarios reales.

Recomendaciones Accionables:
Con base en los resultados y la arquitectura propuesta, se sugieren las siguientes acciones para
optimizar y complementar la estrategia de Alta Disponibilidad:

• Implementar DR Regional: Para protección contra desastres de región completa, es vital


complementar la HA zonal con réplicas de lectura inter-regionales asincrónicas. Esto garantizaría la
continuidad operativa ante una falla de gran escala (Disaster Recovery).
• Monitoreo de Latencia Continuo: Aunque la latencia observada fue baja, se recomienda
monitorear continuamente el impacto de la replicación sincrónica en las aplicaciones sensibles a la
latencia, ajustando el tier de la instancia si fuera necesario.

• Validación en Producción (Pruebas de Failover): Antes del despliegue final en proyectos


empresariales, se debe ejecutar un plan riguroso de pruebas de failover en un entorno real de GCP
(utilizando créditos gratuitos para mitigar el costo) para confirmar las métricas de RTO.

• Plan de Failback Documentado: Documentar detalladamente los procedimientos de failback (el


retorno a la instancia original o principal) es fundamental para escenarios de mantenimiento
planificado y asegurar una transición controlada y segura.
Referencias bibliográficas:
• Varun-Dhawan. (s. f.-a). Monitoring and metrics - Azure Database for PostgreSQL. Microsoft
Learn. [Link]
monitoring
• Gkasar. (s. f.-b). Reliability and high availability in PostgreSQL - Flexible Server - Azure
Database for PostgreSQL - Flexible Server. Microsoft Learn.
• [Link]
• Varun-Dhawan. (s. f.-b). Monitoring and metrics - Azure Database for PostgreSQL. Microsoft
Learn. [Link]
monitoring
• AbhishekMallick-Ms. (s. f.). What is Azure Backup? - Azure Backup. Microsoft Learn.
[Link]
• Akashraokm. (s. f.). Scaling resources - Azure Database for PostgreSQL. Microsoft Learn.
[Link]
resources

También podría gustarte