Saltar al contenido
Telemetry
colección de recetas SQL

Eventos estructurados Recetas SQL

Utilice campos anidados, intervalos de tiempo, funciones de ventana, comprobaciones de latidos y dimensiones seguras en SQL de eventos estructurados reutilizable.

contrato de evento común

Campos que mantienen estas consultas reutilizables

  • timestamp_utc, event_name, fuente, entorno y schema_version
  • correlation_id, request_id, user_id, team_id y versión
  • Campos de estado escrito, duración, monto, recuento y error categorizado

Definiciones antes de SQL

Decisiones que la consulta no puede tomar por usted

  1. 1Utilice un evento para una unidad de trabajo completa en lugar de muchos mensajes parciales.
  2. 2Conserve los campos escritos y las unidades explícitas para que SQL siga siendo portátil.
  3. 3Mantenga secretos y contenido privado sin procesar fuera del contrato del evento.

Secuencia recomendada

Primero la detección de compilación, luego el diagnóstico

Patrones de análisis

Hacer que el resultado explique una decisión.

Emitir un evento de finalización canónico

Registre las entradas, los resultados, la duración, los identificadores estables y el contexto de falla categorizado para una unidad de trabajo completa.

Usar dimensiones acotadas y escritas

Prefiera números explícitos, valores booleanos, unidades y categorías con nombre a valores que requieran análisis o cree grupos ilimitados.

Mantenga la correlación deliberada

Utilice identificadores de solicitud, ejecución, entrega, cuenta o trabajo solo cuando conecten eventos necesarios para una pregunta definida.

recetas completas

Copie la consulta y luego valide las suposiciones.

Principianteservice_heartbeats

Detectar latidos de servicio faltantes

Encuentre servicios, trabajadores o tareas programadas que dejaron de informar antes de que apareciera un evento de falla.

¿Qué fuentes de telemetría esperadas han dejado de enviar latidos?

Ver SQL y resultado
Intermedioagent_events

Consultar eventos de llamadas de herramientas de IA anidadas

Filtre campos anidados con puntos y clasifique las herramientas que fallan sin aplanar la carga útil del evento original.

¿Qué herramientas y argumentos de IA están asociados con la mayor cantidad de llamadas fallidas?

Ver SQL y resultado
Avanzadoapi_requests

Detecte picos en la tasa de errores con una línea de base móvil

Compare cada tasa de error de API por hora con un promedio móvil de siete segmentos en lugar de depender de un umbral permanente.

¿Qué segmentos de tasa de error por hora están muy por encima de su línea de base reciente?

Ver SQL y resultado
Avanzadoworkflow_timeline_events

Reconstruir una línea de tiempo de flujo de trabajo correlacionado

Reconstruya los pasos ordenados del flujo de trabajo entre servicios y el tiempo transcurrido a partir de un identificador de flujo de trabajo compartido.

¿Qué sucedió, en orden, durante el último flujo de trabajo fallido?

Ver SQL y resultado

Adaptar el contrato del evento antes del umbral.

Mantenga el patrón de análisis, pero valide los nombres de las tablas, los tipos de campos, las definiciones comerciales, las ventanas de tiempo y las reglas de volumen mínimo con respecto a sus propios eventos. Cada consulta publicada también se planifica y ejecuta en una tabla escrita vacía con el motor fijado.