Loading
_ DESCIFRANDO CONEXIÓN SEGURA...

Evaluar seguridad frente a evaluar capacidad

5 tareas · 40 min · Principiante

Una cifra de capacidad dice cuánto sabe o cuánto resuelve un modelo; una evaluación de seguridad dice qué hace cuando no debería hacer algo. Son preguntas distintas y se miden con pruebas distintas, aunque las fichas comerciales las mezclen. Llaca Finanzas tiene dos modelos candidatos para su asistente Chungungo, la ficha de cada proveedor, una corrida de capacidad, una corrida de seguridad con su propio conjunto y los techos que aprobó su comité de riesgo. Lo lees todo en un escritorio de solo lectura; no se ejecuta nada.

0 de 5 · 0%

Objetivo de la sala

Una cifra de capacidad dice cuánto sabe o cuánto resuelve un modelo; una evaluación de seguridad dice qué hace cuando no debería hacer algo. Son preguntas distintas y se miden con pruebas distintas, aunque las fichas comerciales las mezclen. Llaca Finanzas tiene dos modelos candidatos para su asistente Chungungo, la ficha de cada proveedor, una corrida de capacidad, una corrida de seguridad con su propio conjunto y los techos que aprobó su comité de riesgo. Lo lees todo en un escritorio de solo lectura; no se ejecuta nada.

Un banco de capacidad pone al modelo frente a preguntas con respuesta correcta —conocimiento, razonamiento, comprensión de lectura— y cuenta aciertos. Una evaluación de seguridad pone al sistema en situaciones de riesgo concretas —datos de otra persona al alcance, una instrucción escondida en un documento, una petición que la empresa no permite atender— y cuenta las veces que hizo lo que no debía. También mide el lado opuesto: cuántas preguntas legítimas rechaza por exceso de cautela.

Que un modelo razone mejor no lo hace más prudente. A veces es al revés: un modelo más capaz sigue con más precisión una instrucción que no debía seguir, o usa mejor una herramienta que tiene demasiado permiso. Por eso la capacidad se mide para saber si el asistente sirve, y la seguridad se mide aparte, con casos del propio sistema, para saber si se puede desplegar.

Responde para continuar

¿Qué relación hay entre una buena cifra de capacidad y la seguridad de un asistente?

Ver pista de ayuda

Piensa en un modelo muy capaz que sigue con precisión una instrucción escondida en un documento.

Las fichas comerciales mezclan afirmaciones de naturaleza muy distinta: cifras de capacidad, datos técnicos, promesas de seguridad. Leerlas bien es clasificar cada una: qué mide, con qué evidencia y si la evidencia sostiene la conclusión. La más peligrosa es la que salta de una cifra de un tipo a una conclusión del otro.

Abre el laboratorio y lee las dos fichas de proveedores/.

Responde para continuar

Escribe el código de la afirmación que deduce que el modelo es seguro a partir de su desempeño en un banco de capacidad.

Ver pista de ayuda

Abre `proveedores/ficha-llareta-14.txt`. Busca la afirmación que empieza hablando de razonamiento y termina hablando de datos.

El equipo de Llaca no se quedó con las fichas: ejecutó su propio conjunto de seguridad, con casos de Chungungo, sus fichas y una herramienta simulada. La tasa de fallos de una categoría es fallos entre casos, y el comité fijó un techo por categoría. Un modelo pasa solo si no supera ningún techo.

Calcula la tasa de cada categoría para cada candidato y compárala con su techo. Fíjate en que el candidato con mejor capacidad no es el que mejor sale en todas.

Responde para continuar

¿Qué categoría incumple su techo con el candidato de Mutisia Labs y lo cumple con el de Neneo IA?

Ver pista de ayuda

Abre `evaluacion/seguridad-2026-09-30.txt` y `politica/techos-por-categoria.txt`. Divide fallos entre casos en cada fila; un valor igual al techo no lo supera.

Decir que una categoría incumple no basta para priorizar: hay que decir por cuánto. La distancia al techo, en puntos porcentuales, es lo que permite comparar un incumplimiento por poco con uno grave.

Responde para continuar

¿Cuántos puntos porcentuales por encima de su techo queda el candidato de Mutisia Labs en la categoría de la tarea anterior? Escribe solo el número.

Ver pista de ayuda

Calcula su tasa en esa categoría y réstale el techo.

Con todo delante, ninguno de los dos candidatos pasa limpio. El de Mutisia Labs gana en capacidad y falla en la categoría más grave para una financiera; el de Neneo IA falla por un punto en rechazos de preguntas legítimas. Una categoría como la de la tarea 3 tiene además una defensa que no depende del modelo: que la herramienta solo devuelva solicitudes del cliente de la sesión.

Responde para continuar

¿Qué recomiendas al comité de riesgo de Llaca?

Ver pista de ayuda

Un techo incumplido no se compensa con capacidad, y un control determinista en la herramienta protege con cualquier modelo.

Inicia sesión para registrar tus puntos y progreso en el ranking.

Whoami-Labs Pro

Whoami-Labs Pro utiliza cookies

Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad