🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónEvaluar seguridad frente a evaluar capacidad
5 tareas · 40 min · Principiante
Una cifra de capacidad dice cuánto sabe o cuánto resuelve un modelo; una evaluación de seguridad dice qué hace cuando no debería hacer algo. Son preguntas distintas y se miden con pruebas distintas, aunque las fichas comerciales las mezclen. Llaca Finanzas tiene dos modelos candidatos para su asistente Chungungo, la ficha de cada proveedor, una corrida de capacidad, una corrida de seguridad con su propio conjunto y los techos que aprobó su comité de riesgo. Lo lees todo en un escritorio de solo lectura; no se ejecuta nada.
Objetivo de la sala
Una cifra de capacidad dice cuánto sabe o cuánto resuelve un modelo; una evaluación de seguridad dice qué hace cuando no debería hacer algo. Son preguntas distintas y se miden con pruebas distintas, aunque las fichas comerciales las mezclen. Llaca Finanzas tiene dos modelos candidatos para su asistente Chungungo, la ficha de cada proveedor, una corrida de capacidad, una corrida de seguridad con su propio conjunto y los techos que aprobó su comité de riesgo. Lo lees todo en un escritorio de solo lectura; no se ejecuta nada.Un banco de capacidad pone al modelo frente a preguntas con respuesta correcta —conocimiento, razonamiento, comprensión de lectura— y cuenta aciertos. Una evaluación de seguridad pone al sistema en situaciones de riesgo concretas —datos de otra persona al alcance, una instrucción escondida en un documento, una petición que la empresa no permite atender— y cuenta las veces que hizo lo que no debía. También mide el lado opuesto: cuántas preguntas legítimas rechaza por exceso de cautela.
Que un modelo razone mejor no lo hace más prudente. A veces es al revés: un modelo más capaz sigue con más precisión una instrucción que no debía seguir, o usa mejor una herramienta que tiene demasiado permiso. Por eso la capacidad se mide para saber si el asistente sirve, y la seguridad se mide aparte, con casos del propio sistema, para saber si se puede desplegar.
Responde para continuar
¿Qué relación hay entre una buena cifra de capacidad y la seguridad de un asistente?
Ver pista de ayuda
Piensa en un modelo muy capaz que sigue con precisión una instrucción escondida en un documento.
Las fichas comerciales mezclan afirmaciones de naturaleza muy distinta: cifras de capacidad, datos técnicos, promesas de seguridad. Leerlas bien es clasificar cada una: qué mide, con qué evidencia y si la evidencia sostiene la conclusión. La más peligrosa es la que salta de una cifra de un tipo a una conclusión del otro.
Abre el laboratorio y lee las dos fichas de proveedores/.
Responde para continuar
Escribe el código de la afirmación que deduce que el modelo es seguro a partir de su desempeño en un banco de capacidad.
Ver pista de ayuda
Abre `proveedores/ficha-llareta-14.txt`. Busca la afirmación que empieza hablando de razonamiento y termina hablando de datos.
El equipo de Llaca no se quedó con las fichas: ejecutó su propio conjunto de seguridad, con casos de Chungungo, sus fichas y una herramienta simulada. La tasa de fallos de una categoría es fallos entre casos, y el comité fijó un techo por categoría. Un modelo pasa solo si no supera ningún techo.
Calcula la tasa de cada categoría para cada candidato y compárala con su techo. Fíjate en que el candidato con mejor capacidad no es el que mejor sale en todas.
Responde para continuar
¿Qué categoría incumple su techo con el candidato de Mutisia Labs y lo cumple con el de Neneo IA?
Ver pista de ayuda
Abre `evaluacion/seguridad-2026-09-30.txt` y `politica/techos-por-categoria.txt`. Divide fallos entre casos en cada fila; un valor igual al techo no lo supera.
Decir que una categoría incumple no basta para priorizar: hay que decir por cuánto. La distancia al techo, en puntos porcentuales, es lo que permite comparar un incumplimiento por poco con uno grave.
Responde para continuar
¿Cuántos puntos porcentuales por encima de su techo queda el candidato de Mutisia Labs en la categoría de la tarea anterior? Escribe solo el número.
Ver pista de ayuda
Calcula su tasa en esa categoría y réstale el techo.
Con todo delante, ninguno de los dos candidatos pasa limpio. El de Mutisia Labs gana en capacidad y falla en la categoría más grave para una financiera; el de Neneo IA falla por un punto en rechazos de preguntas legítimas. Una categoría como la de la tarea 3 tiene además una defensa que no depende del modelo: que la herramienta solo devuelva solicitudes del cliente de la sesión.
Responde para continuar
¿Qué recomiendas al comité de riesgo de Llaca?
Ver pista de ayuda
Un techo incumplido no se compensa con capacidad, y un control determinista en la herramienta protege con cualquier modelo.
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.