AWS Route 53 ARC – Detección y Failover Automático

AWS Route 53 ARC

Detección de Caídas y Failover Automático


¿De qué trata este workshop?

En este workshop aprenderás a construir una solución de alta disponibilidad para un sitio web estático usando servicios nativos de AWS. El objetivo no es recuperación ante desastres: es que el sistema detecte solo cuando el sitio principal cae, notifique a los equipos correspondientes vía SNS → Email / SMS, redirija el tráfico a una página de mantenimiento, y tenga un mecanismo para volver al sitio primario cuando esté recuperado.


Arquitectura del Workshop

                     ┌────────────────────────────────────────┐
   Usuario           │              Route 3                   │
     │               │   DNS Failover + ARC Routing Controls  │
     └──────────────►│                                        │
                     └──────────┬──────────────┬──────────────┘
                                │              │
                     (Primario) │              │  (Secundario/ 
                                ▼              ▼   Fallback)
                     ┌──────────────┐  ┌──────────────────────┐
                     │  EC2 + ALB   │  │  S3 + CloudFront     │
                     │  Sitio Web   │  │  "Algo salió mal..." │
                     │  Principal   │  │  Página Estática     │
                     └──────┬───────┘  └──────────────────────┘
                            │
                     ┌──────▼─────────────────────────────────┐
                     │  Route 53 Health Check                 │
                     │  → Detecta caída del primario          │
                     │  → Activa ARC Routing Control          │
                     │  → SNS → Email + SMS                   │
                     │  → Lambda Failover                     │
                     └────────────────────────────────────────┘

Servicios que utilizaremos

Servicio Rol
EC2 + ALB Sitio web primario (HTML estático servido por nginx)
S3 + CloudFront Página de fallback (“Something went wrong”)
Route 53 DNS, Health Checks, ARC Routing Controls
SNS Notificaciones vía email y SMS
Lambda Automatización del failover y failback
CloudFormation Despliegue de toda la infraestructura
CloudShell Terminal en el browser para ejecutar comandos

Estructura del Workshop

Lab Título Descripción
Lab 0 Prerrequisitos Cuenta AWS, permisos, parámetros iniciales
Lab 1 Sitio Primario EC2 + ALB + nginx vía CloudFormation
Lab 2 Sitio Secundario S3 + CloudFront (página de mantenimiento)
Lab 3 Route 53 Health Checks + ARC Detección automática de caídas
Lab 4 Notificaciones SNS Email y SMS cuando el primario cae
Lab 5 Automatización Lambda Failover y Failback automático
Lab 6 Simulación de Incidente Provocar caída y verificar el flujo completo
Lab 7 Limpieza Eliminar todos los recursos creados

¿A quién está dirigido?

  • Desarrolladores que quieran entender resilencia en AWS
  • Arquitectos de soluciones
  • DevOps / SRE Engineers
  • Cualquier persona curiosa sobre Route 53 y alta disponibilidad

Duración estimada

90 – 120 minutos en total (con todos los labs).

Costo estimado: Menos de $1 USD si se destruye la infraestructura al finalizar. EC2 t3.micro cabe en Free Tier durante el primer año.


Consejo

Todos los pasos incluyen un bloque "✅ Verificación" para confirmar que cada recurso fue creado correctamente antes de avanzar al siguiente paso.

Aviso

Recuerda ejecutar el Lab 7 (Limpieza) al finalizar para evitar costos innecesarios.