🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónLas categorías de riesgo de OWASP para LLM
5 tareas · 45 min · Principiante
Un hallazgo sin categoría es una anécdota; con categoría se puede comparar, priorizar y buscar su remedio. La lista de OWASP para aplicaciones con LLM (edición 2025, con diez categorías, verificada en la fuente oficial) es el vocabulario que piden las ofertas de seguridad de IA. Aquí no ejecutas nada: lees ocho transcripciones de la prueba de Compás, resumidas con palabras, y decides a qué categoría pertenece cada comportamiento y cuál no es un hallazgo. Nunca se reproduce el texto enviado a la aplicación; se cuenta qué se pidió y qué hizo ella.
Objetivo de la sala
Un hallazgo sin categoría es una anécdota; con categoría se puede comparar, priorizar y buscar su remedio. La lista de OWASP para aplicaciones con LLM (edición 2025, con diez categorías, verificada en la fuente oficial) es el vocabulario que piden las ofertas de seguridad de IA. Aquí no ejecutas nada: lees ocho transcripciones de la prueba de Compás, resumidas con palabras, y decides a qué categoría pertenece cada comportamiento y cuál no es un hallazgo. Nunca se reproduce el texto enviado a la aplicación; se cuenta qué se pidió y qué hizo ella.La lista de OWASP nombra los riesgos más importantes de las aplicaciones que usan modelos de lenguaje: inyección de instrucciones, divulgación de información sensible, cadena de suministro, envenenamiento de datos y modelos, manejo inseguro de la salida, agencia excesiva, fuga del mensaje de sistema, debilidades de vectores y embeddings, desinformación y consumo sin límite. Cada una tiene un identificador de LLM01 a LLM10 en la edición 2025.
Sirve para clasificar y hablar el mismo idioma con el cliente y con otros equipos. No sirve como lista de comprobación cerrada: una aplicación puede fallar de una forma que no encaja limpiamente en una sola categoría, y el alcance firmado decide qué se prueba. Abre la tabla lista_owasp_llm_2025 y recórrela una vez.
Responde para continuar
¿Cómo se usa la lista de OWASP para LLM en un encargo?
Ver pista de ayuda
Es un vocabulario compartido de riesgos, no un contrato ni un examen.
En la transcripción T-04 se escribió en un campo un nombre de prueba con una etiqueta inerte. El asistente lo repitió y la ventana del chat lo pintó con formato. El modelo hizo lo esperado; lo que falló es lo que la aplicación hace con la salida. Busca en la lista de categorías la que habla de validar y sanear lo que el modelo produce antes de entregarlo a otros sistemas, y escribe su identificador.
Responde para continuar
¿Qué identificador de la lista corresponde a T-04? Escribe el código, con el formato de la tabla.
Ver pista de ayuda
Mira el nombre de las categorías: una trata de la salida que se usa sin validar.
En T-05 el asistente cambió el beneficiario de una póliza de prueba a partir de un mensaje ambiguo, sin que nadie confirmara. La categoría no se refiere a lo que el modelo dijo, sino a las funciones, permisos y autonomía que se le dieron. La remediación suele estar fuera del texto del modelo: confirmación del usuario, permisos mínimos.
Responde para continuar
¿Qué identificador de la lista corresponde a T-05? Escribe el código.
Ver pista de ayuda
Es la categoría que habla de las funciones y permisos que se le dan al modelo.
En T-03 la respuesta a una pregunta normal incluyó una palabra de control que el equipo de la prueba había dejado a propósito en una nota de reclamo. Nadie la escribió en el chat. Es un detalle de buena práctica: en lugar de plantar una orden dañina, se planta una marca inocua acordada con el cliente, y se observa si aparece donde no debería.
Lo que demuestra es que el modelo trató como instrucción un dato de una fuente que otros pueden editar. La marca no hace daño a nadie y, aun así, prueba el camino.
Responde para continuar
¿Qué prueba la aparición de la palabra de control en la respuesta de T-03?
Ver pista de ayuda
La palabra solo estaba en una nota del índice, no en el mensaje.
Un informe de prueba no es una colección de fallos. Una de las ocho transcripciones no es un hallazgo: la aplicación hizo lo que debía. Se anota igual, en la sección de pruebas sin hallazgo, porque le dice al cliente qué se comprobó y que resistió.
Responde para continuar
¿Qué transcripción no produce hallazgo? Escribe su identificador.
Ver pista de ayuda
Busca la fila en la que la aplicación declinó y no hubo acción ni dato fuera de lo esperado.
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.