🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónQué entra por cada modalidad
4 tareas · 35 min · Principiante
Un asistente que solo lee texto tiene una puerta: la caja donde se escribe. Uno que además mira fotos, abre PDF y escucha notas de voz tiene una puerta por cada modalidad, y cada una llega al modelo por un camino distinto. Pilpilén Seguros es una aseguradora ficticia de autos y hogar; su asistente Cachaña lee lo que mandan clientes, talleres y peritos, resume cada reclamación y propone el siguiente paso al ajustador. Tienes su inventario de entradas y de componentes. Lo lees como quien dibuja el mapa de lo que entra antes de decidir qué se controla. Es solo lectura: nada se ejecuta.
Objetivo de la sala
Un asistente que solo lee texto tiene una puerta: la caja donde se escribe. Uno que además mira fotos, abre PDF y escucha notas de voz tiene una puerta por cada modalidad, y cada una llega al modelo por un camino distinto. Pilpilén Seguros es una aseguradora ficticia de autos y hogar; su asistente Cachaña lee lo que mandan clientes, talleres y peritos, resume cada reclamación y propone el siguiente paso al ajustador. Tienes su inventario de entradas y de componentes. Lo lees como quien dibuja el mapa de lo que entra antes de decidir qué se controla. Es solo lectura: nada se ejecuta.Un modelo multimodal no tiene un canal aparte, más seguro, para las imágenes o el audio. Cada entrada se convierte —por un componente previo o por el propio modelo— en algo que entra al mismo contexto que las instrucciones del sistema. Un PDF llega como el texto que saca un extractor; una foto, como lo que el modelo de visión ve en ella, incluido cualquier texto escrito; una nota de voz, como su transcripción. El problema raíz del módulo 2 sigue intacto: lo que entra como dato puede leerse como orden.
Lo que cambia es la superficie. Cada modalidad suma un convertidor con sus propios errores y un sitio donde el contenido puede decir algo distinto de lo que ve una persona. Por eso el primer trabajo de quien defiende es un inventario: qué entra, quién lo manda, por qué componente pasa y qué control tiene antes de llegar al modelo.
Responde para continuar
¿Por qué una foto que manda un cliente puede llevar una instrucción hasta el modelo de Cachaña?
Ver pista de ayuda
Ejecuta `SELECT * FROM componentes` y lee qué ve de la entrada el modelo-vision y a quién se la entrega.
No todas las entradas de una misma modalidad corren el mismo riesgo. Una foto del daño y una captura de pantalla de una conversación son las dos imágenes, pero la segunda es casi siempre texto escrito por otra persona: lo que diga ese chat llega al modelo de visión como contenido legible. Si además entra sin ningún control previo, es una vía directa de texto de terceros al contexto.
Consulta el inventario de entradas y cruza dos columnas: cómo llega cada entrada al modelo y qué control tiene antes.
Responde para continuar
¿Qué entrada del inventario llega al modelo de visión como imagen sin ningún control previo?
Ver pista de ayuda
Ejecuta `SELECT * FROM entradas` y busca las filas que llegan como imagen directa al modelo de visión; solo una no tiene control.
El origen importa tanto como la modalidad. Lo que produce el personal propio puede equivocarse, pero no está en manos de alguien que quiera engañar al asistente; lo que mandan un cliente o una empresa aliada sí puede estarlo. Un inventario útil separa las entradas por quién las envía, porque las que vienen de fuera son las primeras que necesitan un control.
Cuenta en el inventario las entradas que envía alguien de fuera de Pilpilén y que llegan al modelo sin ningún control previo.
Responde para continuar
¿Cuántas entradas enviadas desde fuera de Pilpilén llegan al modelo sin ningún control previo?
Ver pista de ayuda
En `entradas`, descarta las que envía personal de Pilpilén (la nota de la tabla dice quién lo es) y cuenta las que tienen `control_previo` en ninguno.
Cuando todos los componentes entregan su texto al modelo principal juntos y sin anotar de dónde viene cada parte, el modelo no tiene forma de distinguir la frase del formulario del cliente de la frase que venía escrita en la captura del chat. Tampoco la tiene quien investiga después. Anotar la procedencia no vuelve fiable lo que se lee, pero permite tratar cada fragmento según su origen y reconstruir qué entrada causó una respuesta.
Responde para continuar
Con la nota de la tabla de componentes delante, ¿qué consecuencia tiene que ningún componente anote de qué entrada viene cada fragmento?
Ver pista de ayuda
Ejecuta `SELECT * FROM componentes` y lee la nota del final.
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.