Background job monitoring: de la implementación a la decisión
Un bucle de medición completo background job monitoring conecta un flujo de trabajo propio, un contrato de evento limitado, un dispositivo controlado y una pregunta sobre la que alguien puede actuar.
- 1
Establecer el límite
Registre job_started, job_completed, job_failed y job_retried.
- 2
Captura el resultado
Begin with job_started, job_completed, job_failed and document the grain of each event.
- 3
probar las filas
Agregue alertas para trabajos estancados, fallas repetidas y creación de mensajes no entregados.
- 4
Toma la decisión
¿Qué trabajos fallan o se reintentan con más frecuencia?
Caso de uso versus plantilla
Elige qué medir
Utilice la guía de casos de uso para elegir resultados, límites de eventos y preguntas de análisis. Abra la plantilla correspondiente cuando esté listo para un breve resumen de implementación de copiar y pegar.
Mensaje del agente
Pega esto en tu agente de codificación
Reemplazar YOUR_API_KEY después del registro, solicite al agente que ejecute el flujo del producto y verifique los primeros eventos.
Mensaje de configuración Background job monitoring
Instrumente trabajos en segundo plano y trabajadores asíncronos con Telemetry.
Utilice /skill.md y esta clave API Telemetry: YOUR_API_KEY
Registre los eventos job_started, job_completed y job_failed con job_name, queue_name, attempt, status, duration_ms, scheduled_at, started_at, completed_at, item_count, retry_count y error_type.
Cree un panel que muestre el rendimiento por trabajo, las fallas por trabajo, la duración de p95, el volumen de reintentos, el trabajo pendiente más antiguo y los eventos de mensajes no entregados. Agregue alertas para trabajos estancados y fallas repetidas.Pasos de configuración
- 1Registre job_started, job_completed, job_failed y job_retried.
- 2Incluya cola, nombre del trabajo, intento, duración, recuento de elementos y tipo de error.
- 3Cree un panel para el rendimiento, las fallas, los reintentos y la duración de p95.
- 4Agregue alertas para trabajos estancados, fallas repetidas y creación de mensajes no entregados.
Eventos para capturar
Preguntas que esto desbloquea
- ¿Qué trabajos fallan o se reintentan con más frecuencia?
- ¿Qué colas se están quedando atrás?
- ¿Qué clientes se ven afectados por un trabajo en segundo plano fallido?
Ejemplos de esquemas de eventos
Esquemas de eventos para este flujo de trabajo
Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.
Función relacionada del producto
Continúe este flujo de trabajo en Alertas
Promueva la consulta de confiabilidad revisada a un umbral propio y un flujo de trabajo de respuesta.
Recetas SQL relacionadas
Más ejemplos de SQL
Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.
Medir el reintento del trabajo en segundo plano y la tasa de fallas
¿Qué trabajos en segundo plano consumen más reintentos o aún fallan?
Receta abiertaEncuentre trabajos en segundo plano estancados con SQL
¿Qué trabajos comenzaron pero nunca produjeron un evento terminal?
Receta abiertaMedir el tiempo de espera de la cola por trabajo
¿Qué trabajos esperan más tiempo antes de que un trabajador los inicie?
Receta abiertaMedir el crecimiento de la cola de mensajes fallidos
¿Qué colas agregan trabajos fallidos más rápido de lo que los resuelven?
Receta abiertaDetectar programaciones cron perdidas
¿Qué trabajos programados se ejecutaron más tarde que su intervalo documentado?
Receta abiertaDetectar tormentas de reintentos de trabajos en segundo plano
¿Qué tipos de trabajos dedican más trabajo a los reintentos en este momento?
Receta abiertaCasos de clientes
Historias de clientes relacionadas
Siguiente paso
Cree la clave API que utilizará su agente
El plan gratuito es suficiente para ejecutar el mensaje, enviar eventos de prueba y revisar el primer panel.
Páginas relacionadas
Monitoreo de automatización criptográfica y en cadena
Realice un seguimiento de eventos indexados, acciones de agentes, costos de transacción, flujos de trabajo de billetera, llamadas de herramientas y trabajos de automatización fallidos.
Abrir páginaObservabilidad Claude Code
Proporcione a Claude Code un mensaje que haga que la telemetría forme parte del paso de implementación en lugar de un proyecto de limpieza separado.
Abrir páginaAviso de instrumentación Codex
Un mensaje enfocado que solicita a Codex que instrumente el resto del producto, verifique eventos y resuma las brechas de cobertura.
Abrir página