¡Esta es una revisión vieja del documento!


Configuración de Auto Scaling en AWS

Descripción

El Auto Scaling en AWS es una herramienta que permite ajustar automáticamente la capacidad de computación en la nube según las necesidades de tu aplicación. Mediante el uso de políticas de escalado, Auto Scaling puede añadir o eliminar instancias EC2 de manera automática, manteniendo la disponibilidad y optimizando los costos de operación.

Prerrequisitos

  • Cuenta de AWS Activa
  • Instancias EC2: Al menos una instancia EC2 o una AMI preparada para crear nuevas instancias, o configurar plantilla de lanzamiento.
  • Grupo de Seguridad Configurado: Un grupo de seguridad que permita el tráfico adecuado hacia y desde las instancias que se van a escalar.
  • Grupo de Destino y Balanceador de Carga.
  • Configuración de Red VPC y Subredes configuradas para alojar las instancias EC2.

Procedimiento

A. Instalación básica Accede a la Consola de AWS:

Inicia sesión en la consola de administración de AWS. Navega a EC2 Auto Scaling:

En el panel de servicios, selecciona EC2 y luego elige Auto Scaling Groups. Crear un Launch Template o Launch Configuration:

Un Launch Template o Launch Configuration define los detalles de las instancias EC2 que Auto Scaling lanzará (tipo de instancia, AMI, grupos de seguridad, etc.). En la sección de Auto Scaling Groups, selecciona Create Auto Scaling group. Si aún no tienes un Launch Template o Launch Configuration, sigue las instrucciones para crear uno nuevo: Nombre: Proporciona un nombre único. AMI: Selecciona una AMI previamente configurada. Tipo de Instancia: Elige el tipo de instancia EC2 (por ejemplo, t2.micro, m5.large, etc.). Detalles de Red: Selecciona la VPC y las subredes donde se lanzarán las instancias. Grupo de Seguridad: Selecciona o crea un grupo de seguridad adecuado. B. Configuración Configurar el Grupo de Auto Scaling:

Define el nombre del grupo de Auto Scaling y selecciona el Launch Template o Launch Configuration creado anteriormente. Configuración de Red: Selecciona la VPC y las subredes donde deseas que se lancen las instancias. Balanceador de Carga (opcional): Si utilizas un balanceador de carga, selecciona el grupo de destino que deseas asociar al grupo de Auto Scaling. Establecer Capacidad de Escalado:

Configura los parámetros de escalado: Desired Capacity (Capacidad Deseada): Número inicial de instancias que deseas ejecutar. Minimum Capacity (Capacidad Mínima): Número mínimo de instancias que deben estar en ejecución en todo momento. Maximum Capacity (Capacidad Máxima): Número máximo de instancias que el Auto Scaling puede lanzar. Configurar las Políticas de Escalado:

Las políticas de escalado definen cómo y cuándo Auto Scaling debe añadir o eliminar instancias. Escalado Basado en Métricas: Configura políticas basadas en métricas de CloudWatch (por ejemplo, CPU, memoria, tráfico de red). Escalado Programado: Configura políticas para escalar en momentos específicos del día. C. Configuraciones especiales Configuración de Verificación de Salud (Health Check):

Auto Scaling realiza verificaciones de salud en las instancias EC2 y las reemplaza si fallan. Configura la verificación de salud usando EC2 Status Checks o verificaciones de salud del Load Balancer si estás utilizando un balanceador de carga. Notificaciones de Auto Scaling:

Configura notificaciones para recibir alertas cuando Auto Scaling realice acciones (por ejemplo, lanzar o terminar instancias). Puedes usar Amazon SNS (Simple Notification Service) para recibir alertas por correo electrónico o mensajes de texto. Configurar Protección de Escalado (Scale-In Protection):

Utiliza la protección de escalado para evitar que ciertas instancias sean terminadas durante un evento de reducción de capacidad. Problemas Instancias No Administradas:

Descripción: Las instancias que no fueron lanzadas por el grupo de Auto Scaling no serán gestionadas por él. Solución: Asegúrate de que todas las instancias sean lanzadas y gestionadas por Auto Scaling. Considera eliminar las instancias existentes y dejar que Auto Scaling las recree. Errores de Lanzamiento de Instancias:

Descripción: Auto Scaling puede fallar al lanzar instancias si hay un error en el Launch Template o Launch Configuration (por ejemplo, AMI no disponible, tipo de instancia no soportado). Solución: Verifica y actualiza el Launch Template o Launch Configuration. Auto Scaling No Respeta las Políticas de Escalado:

Descripción: Auto Scaling puede no ajustar la capacidad según lo esperado debido a configuraciones incorrectas de políticas o métricas. Solución: Revisa las políticas de escalado y asegúrate de que las métricas de CloudWatch sean precisas y reflejen el estado de carga real. Costo Inesperado de Escalado:

Descripción: Un escalado excesivo puede generar costos inesperados. Solución: Ajusta las políticas de escalado y establece límites de capacidad para evitar escalado innecesario. Verificaciones de Salud Fallidas:

Descripción: Las verificaciones de salud fallidas pueden causar que Auto Scaling termine instancias saludables erróneamente. Solución: Revisa las configuraciones de verificación de salud y ajusta los parámetros de tiempo y umbrales según sea necesario.

Volver arriba