Background job failure monitor: implementación a decisión
Trate el mensaje como un resumen de implementación. El artefacto útil no es sólo el código copiado, sino un contrato de evento revisado que produce una respuesta confiable.
- 1
Establecer el límite
Instrument the point where job_started becomes final.
- 2
crear el contrato
Start with job_started, job_completed, job_failed and keep every field typed, bounded, and privacy-reviewed.
- 3
ejecutar un dispositivo
Pruebe casos conocidos de éxito, fracaso, reintento y resultados vacíos antes de confiar en resultados agregados.
- 4
Responde la pregunta
¿Qué trabajos fracasan repetidamente?
Plantilla versus caso de uso
Usa esta plantilla para añadir eventos
Copie esta plantilla cuando el objetivo de medición ya esté claro. Utilice la guía de casos de uso correspondientes para revisar los límites de los eventos, las definiciones de éxito y las decisiones que debe admitir el SQL resultante.
Plantilla
Pega esto en tu agente de codificación
Reemplazar YOUR_API_KEY, ejecute el flujo localmente y luego verifique los eventos y paneles generados.
Monitor de fallas en el trabajo en segundo plano
Trabajos en segundo plano de instrumentos con Telemetry.
Utilice /skill.md y esta clave API Telemetry: YOUR_API_KEY
Registre job_started, job_completed, job_failed, job_retried y dead_letter_created con:
job_name, queue_name, attempt, status, duration_ms, scheduled_at, started_at, completed_at, item_count, retry_count, worker_name y error_type.
Cree consultas y un panel para el rendimiento por trabajo, fallas por trabajo, duración de p95, volumen de reintentos, trabajos estancados y eventos de mensajes fallidos más recientes.
No registre cargas útiles de trabajos sin procesar, credenciales, cuerpos de webhooks ni contenido de clientes.Eventos para capturar
Lista de verificación de verificación
Lo que deja un pase completo de instrumentación
Eventos
Los eventos sintéticos llegan a la tabla deseada con nombres y tipos de campos estables.
Consultas
Las primeras consultas SQL devuelven filas plausibles con una ventana de tiempo explícita.
Vistas
Un panel utiliza los campos reales e incluye suficiente contexto para explicar un cambio.
Seguridad
Se verificaron las indicaciones, cuerpos, credenciales, firmas y contenido privado para su redacción.
Ejemplos de esquemas de eventos
Esquemas de eventos para este flujo de trabajo
Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.
Función relacionada del producto
Continúe este flujo de trabajo en Alertas
Promueva la consulta de confiabilidad revisada a un umbral propio y un flujo de trabajo de respuesta.
Recetas SQL relacionadas
Más ejemplos de SQL
Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.
Medir el reintento del trabajo en segundo plano y la tasa de fallas
¿Qué trabajos en segundo plano consumen más reintentos o aún fallan?
Receta abiertaEncuentre trabajos en segundo plano estancados con SQL
¿Qué trabajos comenzaron pero nunca produjeron un evento terminal?
Receta abiertaMedir el crecimiento de la cola de mensajes fallidos
¿Qué colas agregan trabajos fallidos más rápido de lo que los resuelven?
Receta abiertaDetectar programaciones cron perdidas
¿Qué trabajos programados se ejecutaron más tarde que su intervalo documentado?
Receta abiertaDetectar tormentas de reintentos de trabajos en segundo plano
¿Qué tipos de trabajos dedican más trabajo a los reintentos en este momento?
Receta abiertaMás plantillas