Loading
_ DESCIFRANDO CONEXIÓN SEGURA...

Las categorías de riesgo de OWASP para LLM

5 tareas · 45 min · Principiante

Un hallazgo sin categoría es una anécdota; con categoría se puede comparar, priorizar y buscar su remedio. La lista de OWASP para aplicaciones con LLM (edición 2025, con diez categorías, verificada en la fuente oficial) es el vocabulario que piden las ofertas de seguridad de IA. Aquí no ejecutas nada: lees ocho transcripciones de la prueba de Compás, resumidas con palabras, y decides a qué categoría pertenece cada comportamiento y cuál no es un hallazgo. Nunca se reproduce el texto enviado a la aplicación; se cuenta qué se pidió y qué hizo ella.

0 de 5 · 0%

Objetivo de la sala

Un hallazgo sin categoría es una anécdota; con categoría se puede comparar, priorizar y buscar su remedio. La lista de OWASP para aplicaciones con LLM (edición 2025, con diez categorías, verificada en la fuente oficial) es el vocabulario que piden las ofertas de seguridad de IA. Aquí no ejecutas nada: lees ocho transcripciones de la prueba de Compás, resumidas con palabras, y decides a qué categoría pertenece cada comportamiento y cuál no es un hallazgo. Nunca se reproduce el texto enviado a la aplicación; se cuenta qué se pidió y qué hizo ella.

La lista de OWASP nombra los riesgos más importantes de las aplicaciones que usan modelos de lenguaje: inyección de instrucciones, divulgación de información sensible, cadena de suministro, envenenamiento de datos y modelos, manejo inseguro de la salida, agencia excesiva, fuga del mensaje de sistema, debilidades de vectores y embeddings, desinformación y consumo sin límite. Cada una tiene un identificador de LLM01 a LLM10 en la edición 2025.

Sirve para clasificar y hablar el mismo idioma con el cliente y con otros equipos. No sirve como lista de comprobación cerrada: una aplicación puede fallar de una forma que no encaja limpiamente en una sola categoría, y el alcance firmado decide qué se prueba. Abre la tabla lista_owasp_llm_2025 y recórrela una vez.

Responde para continuar

¿Cómo se usa la lista de OWASP para LLM en un encargo?

Ver pista de ayuda

Es un vocabulario compartido de riesgos, no un contrato ni un examen.

En la transcripción T-04 se escribió en un campo un nombre de prueba con una etiqueta inerte. El asistente lo repitió y la ventana del chat lo pintó con formato. El modelo hizo lo esperado; lo que falló es lo que la aplicación hace con la salida. Busca en la lista de categorías la que habla de validar y sanear lo que el modelo produce antes de entregarlo a otros sistemas, y escribe su identificador.

Responde para continuar

¿Qué identificador de la lista corresponde a T-04? Escribe el código, con el formato de la tabla.

Ver pista de ayuda

Mira el nombre de las categorías: una trata de la salida que se usa sin validar.

En T-05 el asistente cambió el beneficiario de una póliza de prueba a partir de un mensaje ambiguo, sin que nadie confirmara. La categoría no se refiere a lo que el modelo dijo, sino a las funciones, permisos y autonomía que se le dieron. La remediación suele estar fuera del texto del modelo: confirmación del usuario, permisos mínimos.

Responde para continuar

¿Qué identificador de la lista corresponde a T-05? Escribe el código.

Ver pista de ayuda

Es la categoría que habla de las funciones y permisos que se le dan al modelo.

En T-03 la respuesta a una pregunta normal incluyó una palabra de control que el equipo de la prueba había dejado a propósito en una nota de reclamo. Nadie la escribió en el chat. Es un detalle de buena práctica: en lugar de plantar una orden dañina, se planta una marca inocua acordada con el cliente, y se observa si aparece donde no debería.

Lo que demuestra es que el modelo trató como instrucción un dato de una fuente que otros pueden editar. La marca no hace daño a nadie y, aun así, prueba el camino.

Responde para continuar

¿Qué prueba la aparición de la palabra de control en la respuesta de T-03?

Ver pista de ayuda

La palabra solo estaba en una nota del índice, no en el mensaje.

Un informe de prueba no es una colección de fallos. Una de las ocho transcripciones no es un hallazgo: la aplicación hizo lo que debía. Se anota igual, en la sección de pruebas sin hallazgo, porque le dice al cliente qué se comprobó y que resistió.

Responde para continuar

¿Qué transcripción no produce hallazgo? Escribe su identificador.

Ver pista de ayuda

Busca la fila en la que la aplicación declinó y no hubo acción ni dato fuera de lo esperado.

Inicia sesión para registrar tus puntos y progreso en el ranking.

Whoami-Labs Pro

Whoami-Labs Pro utiliza cookies

Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad