🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónMedir un guardrail con un conjunto de prueba
5 tareas · 45 min · Principiante
Decir que un filtro «funciona» no es una medida. Una medida es un conjunto de entradas de ejemplo, con la respuesta correcta conocida, y dos números: cuántos ataques detiene y cuántos clientes legítimos bloquea. En esta sala lees el informe de dos versiones del clasificador de entrada de Radal, el asistente de Michay Pagos (empresa inventada): calculas la tasa de detección, detectas el subconjunto cuya muestra es demasiado pequeña para fiarse y traduces la tasa de error al tráfico real, donde la proporción de ataques es otra. Todo es lectura de un informe ficticio; no se ejecuta nada.
Objetivo de la sala
Decir que un filtro «funciona» no es una medida. Una medida es un conjunto de entradas de ejemplo, con la respuesta correcta conocida, y dos números: cuántos ataques detiene y cuántos clientes legítimos bloquea. En esta sala lees el informe de dos versiones del clasificador de entrada de Radal, el asistente de Michay Pagos (empresa inventada): calculas la tasa de detección, detectas el subconjunto cuya muestra es demasiado pequeña para fiarse y traduces la tasa de error al tráfico real, donde la proporción de ataques es otra. Todo es lectura de un informe ficticio; no se ejecuta nada.Un conjunto de prueba tiene entradas de dos tipos: ataques descritos y entradas legítimas. Con eso se miden dos cosas que van en tensión. La tasa de detección es la parte de los ataques que el filtro detiene. La tasa de falsos positivos es la parte de las entradas legítimas que el filtro bloquea por error.
Un filtro que bloquea todo tiene una detección perfecta y es inservible, y uno que no bloquea nada tiene cero falsos positivos y tampoco sirve. Por eso un informe que da solo un número de los dos no dice nada, y comparar dos versiones exige mirar los dos.
Responde para continuar
¿Qué mide la tasa de detección de un filtro sobre un conjunto de prueba?
Ver pista de ayuda
El denominador son solo los ataques, no todas las entradas.
Abre el informe. El conjunto tiene 200 entradas, y el informe separa cuántas son ataques y cuántas son legítimas. Cada versión del clasificador anota cuántos ataques detuvo y cuántas legítimas bloqueó. Con eso se calcula la tasa de la versión 2.
Calcula el porcentaje de ataques que detiene la versión 2.
Responde para continuar
¿Qué porcentaje de los ataques del conjunto detiene la versión 2? Escribe solo el número.
Ver pista de ayuda
Con la terminal, `cat michay/informe-de-las-dos-versiones.txt`. Ataques detenidos entre el total de ataques, por cien.
Una tasa calculada sobre pocas entradas se mueve mucho con un solo caso. Con seis entradas, un acierto de más o de menos cambia la tasa en casi diecisiete puntos. Por eso un informe serio dice cuántas entradas hay detrás de cada cifra, y un subconjunto con muy pocas no sirve para afirmar que el filtro «funciona» ahí, ni para afirmar que falla.
El archivo de subconjuntos reparte los ataques por tipo. Busca el que tiene la muestra más pequeña.
Responde para continuar
¿Qué subconjunto de ataques tiene la muestra más pequeña? Escribe su nombre.
Ver pista de ayuda
Con la terminal, `cat michay/subconjuntos.txt`. Mira la columna de entradas.
En el conjunto de prueba los ataques son cuatro de cada diez entradas porque así se armó, para tener suficientes de cada tipo. En el tráfico real son una fracción mínima. La tasa de falsos positivos se mide sobre las entradas legítimas, y en producción esas son casi todos los mensajes, así que un porcentaje que parece pequeño se convierte en muchas personas.
Calcula cuántos mensajes legítimos bloquearía la versión 2 en un día. Necesitas la tasa de falsos positivos de la versión 2 sobre el conjunto y los datos del tráfico real, y debes restar los ataques antes de aplicarla.
Responde para continuar
¿Cuántos mensajes legítimos bloquearía la versión 2 en un día con el tráfico real? Escribe solo el número.
Ver pista de ayuda
Con la terminal, `cat michay/trafico-real.txt` y `cat michay/informe-de-las-dos-versiones.txt`. Legítimas al día por la tasa de falsos positivos.
La versión 2 detecta más ataques que la 1, pero bloquea más clientes legítimos, y en el tráfico real esa diferencia son cientos de personas al día. No hay una respuesta automática: hay que decidir cuánto vale cada cosa. Una decisión sensata se apoya en el costo de cada error, no en el número más alto de uno solo.
También cuenta que un filtro es una capa más y no la defensa entera: si lo que se gana en detección se cubre con un límite en la herramienta, a lo mejor no hace falta pagar tanto en falsos positivos.
Responde para continuar
La versión 2 detecta más pero bloquea más clientes legítimos. ¿Cómo decides cuál desplegar?
Ver pista de ayuda
Ninguna de las dos cifras decide sola; hay que traducirlas al volumen y al costo.
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.