🔒 Registro cerrado · Apertura oficial próximamente · Acceso exclusivo para alumnos activos
Iniciar SesiónQué es una traza de una llamada a un modelo
5 tareas · 35 min · Principiante
Un registro dice que algo pasó; una traza dice en qué orden, dentro de qué y cuánto tardó cada paso. En una aplicación con un modelo dentro, un solo mensaje de un cliente puede consultar documentos, llamar dos veces al modelo y ejecutar una herramienta, y cuando algo sale mal hace falta ese recorrido completo. Canastero Créditos es una financiera ficticia de créditos de consumo; su asistente Chiricoca responde dudas, simula cuotas y agenda llamadas. Tienes una traza del 2 de octubre de 2026 y la configuración de su pasarela de modelos. Las lees como quien aprende a seguir el camino de una petición. Es solo lectura: nada se ejecuta.
Objetivo de la sala
Un registro dice que algo pasó; una traza dice en qué orden, dentro de qué y cuánto tardó cada paso. En una aplicación con un modelo dentro, un solo mensaje de un cliente puede consultar documentos, llamar dos veces al modelo y ejecutar una herramienta, y cuando algo sale mal hace falta ese recorrido completo. Canastero Créditos es una financiera ficticia de créditos de consumo; su asistente Chiricoca responde dudas, simula cuotas y agenda llamadas. Tienes una traza del 2 de octubre de 2026 y la configuración de su pasarela de modelos. Las lees como quien aprende a seguir el camino de una petición. Es solo lectura: nada se ejecuta.Una traza es el recorrido completo de una petición. Se compone de spans: cada span es un paso con nombre, momento de inicio, duración, estado y atributos, y todos los spans de una misma petición comparten el identificador de la traza. Cada span, salvo el primero, apunta a su padre, y así se forma un árbol: la petición HTTP contiene al agente, y el agente contiene la búsqueda de documentos, las llamadas al modelo y la ejecución de herramientas.
OpenTelemetry es el proyecto abierto, alojado en la Cloud Native Computing Foundation, que define cómo se generan y se envían trazas, métricas y registros. Tiene convenciones semánticas específicas para IA generativa, todavía en desarrollo, que fijan cómo se llaman las operaciones (por ejemplo chat, retrieval, execute_tool o invoke_agent) y qué atributos lleva cada span. Con eso, una traza escrita por una aplicación se puede leer en cualquier plataforma de trazas compatible, incluidas las de código abierto.
Responde para continuar
¿Qué aporta una traza que no aporta una línea de registro por cada llamada al modelo?
Ver pista de ayuda
Abre `leeme.txt` y fíjate en la columna `padre` del archivo de la traza.
El árbol importa cuando se investiga. Si una herramienta falla o tarda, la pregunta siguiente es dentro de qué se ejecutó: si cuelga directamente de la petición, la llamó el código de la aplicación; si cuelga del span del agente, fue una decisión del agente, tomada después de que el modelo pidiera usarla. Esa diferencia separa un fallo de programación de un comportamiento del agente.
Abre la traza en la carpeta trazas y localiza el span que ejecutó la herramienta de simulación de cuota. Anota el identificador de su padre.
Responde para continuar
¿Qué span_id es el padre del span que ejecutó la herramienta?
Ver pista de ayuda
Busca la fila cuyo nombre empieza por `execute_tool` y lee la columna `padre`.
La duración del span raíz es lo que esperó el cliente. Las duraciones de los hijos explican por qué: en un asistente casi siempre la mayor parte se va en las llamadas al modelo, y cada vuelta de herramienta añade una llamada más. Por eso un agente que encadena herramientas suele tardar varias veces lo que tarda una pregunta directa, y una traza permite medirlo paso a paso en vez de adivinarlo.
Suma la duración de todas las llamadas al modelo de esta traza.
Responde para continuar
¿Cuántos milisegundos de la traza se fueron en las llamadas al modelo?
Ver pista de ayuda
Suma `duracion_ms` de los spans cuyo nombre empieza por `chat`.
La aplicación no siempre sabe qué modelo le contestó. Muchas arquitecturas piden un alias a una pasarela, y la pasarela decide: el modelo principal, otro de respaldo si el primero rechaza la petición, o una versión nueva que el proveedor publicó con el mismo nombre. Por eso la convención distingue el modelo pedido (gen_ai.request.model) del modelo que dice haber respondido (gen_ai.response.model). Si solo se registra el primero, un cambio de comportamiento no se puede atribuir.
Lee los atributos de las dos llamadas al modelo de la traza y la configuración de la pasarela. Anota qué modelo respondió la segunda llamada.
Responde para continuar
¿Qué modelo respondió realmente la segunda llamada al modelo de la traza?
Ver pista de ayuda
Compara `gen_ai.request.model` y `gen_ai.response.model` en los atributos del segundo span `chat`.
Las convenciones de OpenTelemetry para IA generativa proponen nombrar el span de una llamada al modelo con la operación y el modelo pedido, como chat asistente-estandar, y no con lo que escribió el cliente. Hay dos razones. El nombre se usa para agrupar, filtrar y construir métricas, y si cada span tuviera un nombre distinto no se podría agrupar nada. Y el nombre se ve en todas partes, sin los controles de acceso que se aplican al contenido, así que no puede llevar datos de nadie.
Responde para continuar
¿Por qué el nombre de un span de llamada al modelo lleva la operación y el modelo, y no el texto del cliente?
Ver pista de ayuda
Mira la columna `nombre` de la traza: ¿cuántos spans comparten el mismo nombre?
Whoami-Labs Pro
Whoami-Labs Pro utiliza cookies
Utilizamos cookies y almacenamiento local para el funcionamiento del sitio, seguridad de sesión y, si lo autorizas, analítica y marketing. Puedes aceptar, rechazar o personalizar. Política de Privacidad
Preferencias
Configuraciones de cookies
Elige qué categorías permitir. Las esenciales siempre están activas. Consulta la Política de Privacidad.
Esenciales
Siempre activas · sesión, CSRF, tema y esta preferencia
Necesarias para iniciar sesión, proteger formularios (CSRF) y recordar tu elección de cookies y tema. Sin ellas la plataforma no funciona de forma segura.
Analíticos
Hoy no activos en la plataforma; listos para cuando se conecten
Nos ayudan a entender uso de cursos y páginas. Si los activas, se usarán cuando conectemos analítica; hasta entonces no se carga ningún tracker.
Marketing
Hoy no activos; campañas futuras solo con tu permiso
Comunicaciones o campañas. No activos hoy en la plataforma; quedarán listos si los conectamos y solo si los permites.