Entradas

Mostrando las entradas etiquetadas como Troubleshooting

Health Checks en Auto Scaling Groups: Cuándo cambiar de EC2 a ELB y por qué tu ASG termina instancias sanas

Tu Auto Scaling Group está terminando instancias que aparentemente funcionan bien — el proceso corre, el sistema operativo responde, pero el ASG las reemplaza de todas formas. Antes de cambiar el tipo de health check de 'EC2' a 'ELB', necesitas entender exactamente qué evalúa cada modo y qué consecuencias tiene ese cambio en producción. TL;DR — Resumen rápido Aspecto Health Check EC2 Health Check ELB ¿Qué evalúa? Estado del hipervisor / instancia EC2 Respuesta HTTP/TCP de la aplicación Fuente de verdad AWS EC2 status checks Target Group health del Load Balancer Instancia 'running' pero app caída Considera la instancia sana Considera la instancia no sana Riesgo principal Tráfico dirigido a instancias sin app Terminaciones en cascada si el LB tiene mala configuración Cuándo usarlo Workloads sin LB, workers, batch Aplicaciones web detrás de ALB/NLB Cómo funcionan los health...

ALB Devuelve 502 Bad Gateway: Diagnóstico Cuando las Instancias Aparecen como Saludables

El 502 de un Application Load Balancer con instancias marcadas como 'Healthy' es uno de los escenarios más frustrantes en producción: el health check pasa, el target group parece correcto, pero el tráfico real falla. El problema no está en la disponibilidad del backend — está en lo que el backend responde cuando recibe una petición HTTP real. TL;DR: Causas Comunes del 502 en ALB Causa Síntoma Observable Capa Afectada Respuesta HTTP malformada del backend 502 inmediato, sin latencia Aplicación Conexión cerrada prematuramente por el backend 502 con target_processing_time muy bajo TCP/Aplicación Keep-alive timeout desalineado 502 intermitente bajo carga TCP Respuesta excede límites de cabeceras HTTP 502 en rutas específicas con cabeceras grandes Aplicación Backend cierra conexión durante la respuesta 502 con target_processing_time parcial Aplicación/Red Cómo Funciona la Conexión ALB–Back...

EC2 SSH Connection Timeout: Qué revisar en Security Groups para resolver el error

Lanzaste una instancia EC2, intentas conectarte por SSH y recibes un Connection timed out que no da ninguna pista sobre dónde está el problema. Este error de timeout en SSH es uno de los más frecuentes al trabajar con EC2, y casi siempre apunta a una capa de red bloqueando el tráfico antes de que llegue al sistema operativo — no a un problema con el servidor en sí. TL;DR: Resumen rápido del diagnóstico Capa Qué verificar Herramienta Security Group Regla inbound TCP/22 desde tu IP Consola AWS / CLI Network ACL Reglas inbound y outbound para TCP/22 Consola VPC / CLI Tabla de rutas Ruta hacia Internet Gateway (0.0.0.0/0) Consola VPC / CLI IP pública La instancia tiene Elastic IP o IP pública asignada Consola EC2 Subnet La subnet es pública (auto-assign public IP activo) Consola VPC Cómo funciona el flujo de red en EC2 antes de que llegue SSH Antes de diagnosticar, hay que entender qué capas atra...