🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónLLM09 y LLM10: desinformación y consumo sin límites
5 tareas · 35 min · Principiante
Las dos últimas entradas de la lista no necesitan a nadie con malas intenciones para causar daño. Una trata de las respuestas falsas dichas con seguridad, y de la confianza excesiva de quien las lee; la otra, del uso del modelo sin límites, que agota el servicio, dispara la factura o deja copiar el comportamiento del modelo a base de consultas. Lees una muestra de respuestas de Murta, sus límites configurados y el consumo de una semana de Petrillo Seguros. Todo es lectura de documentos ficticios; no se ejecuta nada.
Objetivo de la sala
Las dos últimas entradas de la lista no necesitan a nadie con malas intenciones para causar daño. Una trata de las respuestas falsas dichas con seguridad, y de la confianza excesiva de quien las lee; la otra, del uso del modelo sin límites, que agota el servicio, dispara la factura o deja copiar el comportamiento del modelo a base de consultas. Lees una muestra de respuestas de Murta, sus límites configurados y el consumo de una semana de Petrillo Seguros. Todo es lectura de documentos ficticios; no se ejecuta nada.La desinformación (LLM09) agrupa dos cosas. Por un lado, el modelo produce afirmaciones falsas o sin base con el mismo tono con el que acierta. Por otro, el sistema o las personas confían en esas afirmaciones sin comprobarlas. La entrada pide revisar ambas: cuánto de lo que se afirma tiene respaldo en una fuente, y qué hace el diseño cuando no lo tiene.
Los controles habituales son anclar la respuesta en documentos recuperados y comprobar que lo citado existe y dice lo que se afirma, avisar al usuario cuando no hay respaldo, y llevar a una persona las decisiones que tienen consecuencias. Un prompt que pide «no inventar» ayuda poco: no le da al modelo un dato que no tiene.
Responde para continuar
¿Qué control ataca mejor el riesgo de que Murta afirme coberturas que la póliza no da?
Ver pista de ayuda
Busca el control que no depende de que el modelo se comporte bien.
Abre la muestra de afirmaciones. Cada una se revisó contra lo que se recuperó en ese caso. Cuenta como sin respaldo toda afirmación que no tiene una fuente que la sostenga, incluida la que la fuente contradice.
Responde para continuar
¿Qué porcentaje de las afirmaciones de la muestra no tiene respaldo en lo recuperado? Escribe solo el número.
Ver pista de ayuda
Con la terminal, `cat petrillo/muestra-de-respuestas.txt`. Cuenta las filas cuyo respaldo no empieza por «si» y divide entre el total.
No todas las afirmaciones sin respaldo pesan lo mismo. Que el modelo diga algo que no se pudo comprobar es un problema; que diga lo contrario de lo que la fuente recuperada dice es peor, porque el sistema tenía el dato correcto delante. Ese caso apunta a que falta una comprobación entre lo recuperado y lo afirmado.
Responde para continuar
¿Qué afirmación de la muestra contradice lo que dice la fuente recuperada? Escribe su identificador.
Ver pista de ayuda
Busca en la última columna una fila que no diga ni «si» ni «no».
El consumo sin límites (LLM10) se revisa en la configuración: tamaño de entrada y de salida, consultas por usuario, tope de gasto, y los límites de las tareas que el asistente encadena solo. Este último enlaza con la agencia excesiva: un agente que puede repetir pasos sin tope consume sin medida aunque nadie lo pida, por un bucle o por una orden que lo empuja a seguir.
Abre la tabla de límites de Murta y busca el parámetro del agente que no tiene tope.
Responde para continuar
¿Qué parámetro del agente de Murta no tiene límite? Escribe su nombre tal como aparece.
Ver pista de ayuda
Con la terminal, `cat petrillo/limites.txt`. Dos filas dicen «sin limite»; solo una es del agente.
La otra fila sin límite es la cuota de las cuentas de integración, y el consumo de la semana muestra una de esas cuentas con un patrón llamativo: consultas sin conversación que recorren en orden todas las combinaciones posibles. Además del costo, ese patrón es la señal típica de quien intenta reconstruir el comportamiento del modelo a partir de sus respuestas, que la entrada LLM10 también cubre. La defensa es la misma: cuota por cuenta y vigilancia del patrón.
Calcula cuánto costó esa cuenta en la semana.
Responde para continuar
¿Cuántos USD costaron las consultas de la cuenta con el patrón de recorrido sistemático? Escribe solo el número.
Ver pista de ayuda
Con la terminal, `cat petrillo/consumo-de-octubre.txt`. Divide sus consultas entre mil y multiplica por el precio.
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.