AWS Route 53 ARC – Detección y Failover Automático
AWS Route 53 ARC
Detección de Caídas y Failover Automático
¿De qué trata este workshop?
En este workshop aprenderás a construir una solución de alta disponibilidad para un sitio web estático usando servicios nativos de AWS. El objetivo no es recuperación ante desastres: es que el sistema detecte solo cuando el sitio principal cae, notifique a los equipos correspondientes vía SNS → Email / SMS, redirija el tráfico a una página de mantenimiento, y tenga un mecanismo para volver al sitio primario cuando esté recuperado.
Arquitectura del Workshop
┌────────────────────────────────────────┐
Usuario │ Route 3 │
│ │ DNS Failover + ARC Routing Controls │
└──────────────►│ │
└──────────┬──────────────┬──────────────┘
│ │
(Primario) │ │ (Secundario/
▼ ▼ Fallback)
┌──────────────┐ ┌──────────────────────┐
│ EC2 + ALB │ │ S3 + CloudFront │
│ Sitio Web │ │ "Algo salió mal..." │
│ Principal │ │ Página Estática │
└──────┬───────┘ └──────────────────────┘
│
┌──────▼─────────────────────────────────┐
│ Route 53 Health Check │
│ → Detecta caída del primario │
│ → Activa ARC Routing Control │
│ → SNS → Email + SMS │
│ → Lambda Failover │
└────────────────────────────────────────┘Servicios que utilizaremos
| Servicio | Rol |
|---|---|
| EC2 + ALB | Sitio web primario (HTML estático servido por nginx) |
| S3 + CloudFront | Página de fallback (“Something went wrong”) |
| Route 53 | DNS, Health Checks, ARC Routing Controls |
| SNS | Notificaciones vía email y SMS |
| Lambda | Automatización del failover y failback |
| CloudFormation | Despliegue de toda la infraestructura |
| CloudShell | Terminal en el browser para ejecutar comandos |
Estructura del Workshop
| Lab | Título | Descripción |
|---|---|---|
| Lab 0 | Prerrequisitos | Cuenta AWS, permisos, parámetros iniciales |
| Lab 1 | Sitio Primario | EC2 + ALB + nginx vía CloudFormation |
| Lab 2 | Sitio Secundario | S3 + CloudFront (página de mantenimiento) |
| Lab 3 | Route 53 Health Checks + ARC | Detección automática de caídas |
| Lab 4 | Notificaciones SNS | Email y SMS cuando el primario cae |
| Lab 5 | Automatización Lambda | Failover y Failback automático |
| Lab 6 | Simulación de Incidente | Provocar caída y verificar el flujo completo |
| Lab 7 | Limpieza | Eliminar todos los recursos creados |
¿A quién está dirigido?
- Desarrolladores que quieran entender resilencia en AWS
- Arquitectos de soluciones
- DevOps / SRE Engineers
- Cualquier persona curiosa sobre Route 53 y alta disponibilidad
Duración estimada
90 – 120 minutos en total (con todos los labs).
Costo estimado: Menos de $1 USD si se destruye la infraestructura al finalizar. EC2 t3.micro cabe en Free Tier durante el primer año.
Consejo
Todos los pasos incluyen un bloque "✅ Verificación" para confirmar que cada recurso fue creado correctamente antes de avanzar al siguiente paso.
Aviso
Recuerda ejecutar el Lab 7 (Limpieza) al finalizar para evitar costos innecesarios.