Loading
_ DESCIFRANDO CONEXIÓN SEGURA...

Disponibilidad y degradación: qué sigue funcionando cuando algo falla

5 tareas · 36 min · Principiante

En telecomunicaciones la disponibilidad es parte de la seguridad: una recarga que no responde, un servicio de emergencia caído o un partido que se corta son incidentes aunque nadie haya atacado nada. La pregunta de diseño es qué hace cada servicio cuando falla aquello de lo que depende: se detiene o sigue en un modo reducido. En esta sala lees el catálogo de servicios de Cabledoro, ficticio, con su criticidad, sus dependencias y su tiempo objetivo de recuperación, y la línea de tiempo de una caída del 6 de octubre de 2026, para ver qué servicios no tenían plan B y qué sistema era el punto común.

0 de 5 · 0%

Objetivo de la sala

En telecomunicaciones la disponibilidad es parte de la seguridad: una recarga que no responde, un servicio de emergencia caído o un partido que se corta son incidentes aunque nadie haya atacado nada. La pregunta de diseño es qué hace cada servicio cuando falla aquello de lo que depende: se detiene o sigue en un modo reducido. En esta sala lees el catálogo de servicios de Cabledoro, ficticio, con su criticidad, sus dependencias y su tiempo objetivo de recuperación, y la línea de tiempo de una caída del 6 de octubre de 2026, para ver qué servicios no tenían plan B y qué sistema era el punto común.

El tiempo objetivo de recuperación (RTO) es el plazo en que el servicio debe volver a funcionar. El modo degradado es lo que el servicio hace mientras tanto: por ejemplo, un autoservicio que pasa a solo lectura, un streaming que baja la calidad o una cola que guarda mensajes para entregarlos después. Son dos medidas complementarias. Un RTO de quince minutos sin modo degradado significa quince minutos de servicio caído por completo; con un modo degradado, esos minutos son de servicio parcial.

Responde para continuar

¿Qué aporta un modo degradado que no aporta un tiempo objetivo de recuperación?

Ver pista de ayuda

Piensa en qué hace el servicio durante los minutos de la caída.

La criticidad 1 es la más alta: son los servicios cuya caída pone en riesgo a las personas o al negocio. Un servicio de criticidad 1 cuyo modo degradado es «ninguno» deja de funcionar por completo cuando falla su dependencia. Es el hallazgo que más pesa en un informe de resiliencia, y se encuentra cruzando dos columnas del catálogo.

Abre el laboratorio y filtra los servicios sin modo degradado.

Responde para continuar

¿Qué servicio de criticidad 1 no tiene modo degradado?

Ver pista de ayuda

Escribe `SELECT servicio, criticidad, modo_degradado FROM servicios WHERE modo_degradado = 'ninguno'` y fíjate en la criticidad de cada fila.

Cuando muchos servicios dependen de un mismo sistema, ese sistema es un punto único de falla: si cae, caen todos juntos. El catálogo lista de qué sistema depende cada servicio, y contar cuántos cuelgan de cada uno muestra dónde invertir primero en redundancia o en aislamiento. Un sistema muy usado merece más protección que uno que solo atiende a un servicio.

Responde para continuar

¿De qué sistema dependen más servicios del catálogo?

Ver pista de ayuda

Escribe `SELECT depende_de, count(*) AS servicios FROM servicios GROUP BY depende_de ORDER BY servicios DESC`.

La línea de tiempo registra cuatro momentos de una caída del 6 de octubre de 2026. Para evaluar la gravedad hay que medir la duración del servicio afectado, desde que dejó de responder hasta que volvió, y compararla con su tiempo objetivo. La alarma de latencia previa no cuenta: el servicio todavía respondía.

Responde para continuar

¿Cuántos minutos estuvo sin responder el servicio de recarga? Escribe solo el número.

Ver pista de ayuda

Consulta `SELECT * FROM linea_de_tiempo` y resta la hora en que dejó de responder a la hora en que volvió.

El análisis conecta tres cosas: el servicio crítico no tenía modo degradado, estuvo caído mucho más que su tiempo objetivo y dependía de un sistema que soporta a otros dos servicios. La recomendación útil ataca la causa y no el síntoma: diseñar un modo degradado para el servicio crítico (por ejemplo, aceptar operaciones en una cola y confirmarlas cuando el sistema vuelva) y probarlo, y estudiar cómo aislar el sistema común. Prometer que no volverá a caer no es una recomendación.

Responde para continuar

¿Cuál es la recomendación más útil tras la caída del servicio de recarga?

Ver pista de ayuda

La recomendación debe cambiar lo que ocurre la próxima vez que algo falle.

Inicia sesión para registrar tus puntos y progreso en el ranking.

Whoami-Labs Pro

Whoami-Labs Pro utiliza cookies

Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad