Loading
_ DESCIFRANDO CONEXIÓN SEGURA...

Alcance y reglas de un encargo con LLM

5 tareas · 40 min · Principiante

Las vacantes de pentester piden cada vez más probar aplicaciones con un modelo de lenguaje dentro. El encargo se parece al de una aplicación web, pero tiene piezas nuevas y, sobre todo, piezas que no son del cliente. Seguros Azahar te contrata para evaluar Compás, el asistente de su portal de asegurados, con autorización escrita y datos sintéticos. Antes de tocar nada lees el contrato: qué se prueba, quién opera cada pieza, con qué tope y qué hacer si algo se sale del papel. No ejecutas nada: lees el contrato y decides.

0 de 5 · 0%

Objetivo de la sala

Las vacantes de pentester piden cada vez más probar aplicaciones con un modelo de lenguaje dentro. El encargo se parece al de una aplicación web, pero tiene piezas nuevas y, sobre todo, piezas que no son del cliente. Seguros Azahar te contrata para evaluar Compás, el asistente de su portal de asegurados, con autorización escrita y datos sintéticos. Antes de tocar nada lees el contrato: qué se prueba, quién opera cada pieza, con qué tope y qué hacer si algo se sale del papel. No ejecutas nada: lees el contrato y decides.

Una aplicación con un modelo de lenguaje es una aplicación común más un componente que lee texto y decide qué hacer con él. Eso añade tres cosas al encargo. Primero, el componente nuevo casi nunca es del cliente: el modelo suele servirlo un proveedor por API, con sus propias condiciones. Segundo, el comportamiento no es determinista: la misma entrada puede dar respuestas distintas, así que una prueba se repite y se anota cuántas veces ocurrió. Tercero, el modelo recibe como contexto textos de muchas fuentes y no distingue quién los escribió, así que el alcance debe nombrar esas fuentes.

La lista de OWASP para aplicaciones con LLM (edición 2025, la vigente cuando se escribió esta sala) es el vocabulario con el que se clasifican los riesgos. No es una lista de pruebas que haya que agotar: el alcance firmado manda.

Responde para continuar

¿Qué cambia respecto a un encargo web común cuando la aplicación lleva un modelo de lenguaje?

Ver pista de ayuda

Dos rasgos nuevos: quién opera el modelo y que no responde igual dos veces.

Abre la consola de la estación y consulta las tablas del contrato de Azahar. La tabla componentes_del_asistente lista cada pieza del asistente con quién la opera y si entra en el alcance. La regla de oro del encargo es sencilla: el cliente solo puede autorizar lo que es suyo. Lo que opera otra empresa se prueba con la autorización escrita de esa empresa, o no se prueba.

Responde para continuar

¿Qué tercero opera el modelo de lenguaje, que queda fuera del alcance? Escribe solo su primer nombre.

Ver pista de ayuda

Mira la columna operado_por de la fila del modelo de lenguaje.

A mitad de la ventana, el responsable de producto de Azahar te dice por mensaje de chat: «ya que estás, mira también si el servicio del modelo se puede saltar sus propios filtros, que nos preocupa». Vuelve al contrato: la fila de cambios de alcance dice cómo se modifica el alcance, y la fila de terceros dice qué pasa con el operador del modelo.

El filtro de ese servicio lo opera Lumenia, y lo que un cliente pide de palabra no sustituye al contrato. Si lo probaras y algo saliera mal, el contrato no te protegería.

Responde para continuar

¿Qué haces con la petición de probar los filtros del servicio del modelo?

Ver pista de ayuda

Dos filas del contrato lo resuelven: cómo se cambia el alcance y qué se dice de terceros.

El contrato fija un tope de solicitudes al asistente. En un encargo con LLM el tope pesa por partida doble: cada solicitud puede costar dinero al cliente y consumo del operador del modelo. Tu plan de pruebas se calcula con la cifra más alta que el contrato permite, para saber si cabe.

Responde para continuar

Como máximo, ¿cuántas solicitudes al asistente permite el contrato en una hora? Escribe solo el número.

Ver pista de ayuda

El tope está dado por minuto; una hora tiene 60 minutos.

Dos reglas de enfrentamiento cambian tu forma de trabajar: las transcripciones se guardan completas con fecha y hora, y cada prueba se repite las veces que el protocolo dice y se anota cuántas veces ocurrió. Lo primero te protege: puedes demostrar qué hiciste y cuándo. Lo segundo hace honesto tu informe.

Responde para continuar

¿Para qué sirve anotar cuántas veces ocurrió cada comportamiento?

Ver pista de ayuda

Una sola vez no demuestra nada sobre un sistema que varía.

Inicia sesión para registrar tus puntos y progreso en el ranking.

Whoami-Labs Pro

Whoami-Labs Pro utiliza cookies

Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad