🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónEscalado automático y los límites que no se ven
5 tareas · 40 min · Principiante
El escalado automático se vende como una garantía: si sube la carga, aparecen más servidores. Es cierto mientras nada se interponga, y casi siempre algo se interpone: una cuota de la cuenta, un máximo que alguien fijó sin pensar, un chequeo de salud que mata instancias sanas antes de que terminen de arrancar. Calamar Pagos tiene tres grupos de escalado en sa-east-1 y los registros de los últimos días. Tu trabajo es leerlos como evidencia: dónde se quedó corto el escalado, por qué, y qué control habría evitado el susto. Todo es lectura de tablas de ejemplo; no se lanza ninguna instancia.
Objetivo de la sala
El escalado automático se vende como una garantía: si sube la carga, aparecen más servidores. Es cierto mientras nada se interponga, y casi siempre algo se interpone: una cuota de la cuenta, un máximo que alguien fijó sin pensar, un chequeo de salud que mata instancias sanas antes de que terminen de arrancar. Calamar Pagos tiene tres grupos de escalado en sa-east-1 y los registros de los últimos días. Tu trabajo es leerlos como evidencia: dónde se quedó corto el escalado, por qué, y qué control habría evitado el susto. Todo es lectura de tablas de ejemplo; no se lanza ninguna instancia.Un grupo de escalado tiene tres números: el mínimo (por debajo no baja), el deseado (lo que intenta mantener hoy) y el máximo (por encima no sube). El mínimo protege la disponibilidad. El máximo parece un detalle de costos, y es también un control de seguridad: un pico de peticiones, legítimo o hostil, hace subir la capacidad hasta ese tope. Sin tope, el pico se convierte en una factura sin techo y en un consumo de la cuota de la cuenta que deja sin sitio a las demás cargas.
Por eso el máximo se fija contra tres cosas a la vez: lo que soporta la base de datos que hay detrás, lo que cuesta, y lo que queda de cuota.
Responde para continuar
¿Por qué un grupo de escalado debe tener un máximo bien pensado y no el número más alto que permita la cuenta?
Ver pista de ayuda
Piensa en lo que pasa con la cuenta si el tráfico se dispara durante una noche entera.
Cada cuenta tiene una cuota de vCPU por región y por tipo de uso. Es un límite de la cuenta, no del grupo: todas las cargas de la cuenta de producción lo comparten. Cuando el escalado pide más capacidad de la que la cuota permite, el servicio responde con un error y el grupo se queda por debajo de lo que pidió, sin que nadie lo avise si no hay una alarma sobre ese error.
Abre las tablas cuotas y grupos. El grupo de liquidación lanza instancias de un tamaño fijo, y la cuota ya tiene una parte en uso.
Responde para continuar
¿Cuántas instancias más del grupo de liquidación caben antes de tocar la cuota de vCPU de la región?
Ver pista de ayuda
Resta lo en uso a la cuota y divide entre los vCPU de una instancia del grupo.
Los eventos de escalado dicen más que las métricas. Un lanzamiento fallido tiene un código de error, y el código distingue problemas con remedios muy distintos: un error de capacidad en una zona se resuelve lanzando en otra, y el servicio suele hacerlo solo; un error de cuota no se resuelve solo, porque el límite es de la cuenta y alguien tiene que pedir más o liberar lo que no se usa.
Lee la tabla eventos_de_escalado. Hay dos grupos con lanzamientos fallidos, por causas distintas.
Responde para continuar
¿Qué grupo dejó de cumplir su capacidad deseada porque la cuenta llegó a su cuota de vCPU?
Ver pista de ayuda
Uno de los dos fallos se resolvió solo en otra zona; el otro se repite y la capacidad no se cumple.
Un grupo de escalado vigila la salud de sus instancias y reemplaza las que dejan de estar sanas. Para no matar instancias que aún están arrancando, existe un periodo de gracia: el tiempo que espera antes de empezar a mirar su salud. Si el periodo de gracia es menor que lo que tarda en arrancar la aplicación, cada instancia nueva se marca como no sana antes de estar lista y el grupo entra en un ciclo de lanzar y terminar que consume cuota y nunca llega a servir.
Compara en las tablas arranque y eventos_de_escalado: hay un grupo en que las instancias se terminan por salud a los pocos segundos de lanzarse.
Responde para continuar
¿Cuántos segundos hay que subir, como mínimo, el periodo de gracia del grupo que entra en ese ciclo para que su instancia llegue a estar lista antes del primer chequeo?
Ver pista de ayuda
Resta el periodo de gracia al tiempo de arranque de la aplicación en la fila de ese grupo.
Escalar y reemplazar instancias solo es seguro si las instancias son prescindibles. Una instancia que guarda sesiones de usuarios o archivos subidos en su disco local pierde esos datos cada vez que el grupo la termina, ya sea por una bajada de carga, un chequeo de salud o la caída de una zona. La carga ideal para un grupo de escalado no guarda estado en la instancia: sesiones, archivos y colas viven en servicios aparte que no dependen de ella.
Responde para continuar
Para que el escalado automático y el reemplazo por salud no pierdan información, ¿qué debe cumplir la carga?
Ver pista de ayuda
Una instancia que se puede terminar en cualquier momento no puede ser la única dueña de un dato.
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.