AWS SQS Queue Observability: del límite a la fila verificada
Utilice AWS SQS Queue Observability en un límite de aplicación controlado, mantenga el contrato de evento pequeño y verifique un resultado conocido antes de crear vistas agregadas.
- 1
Elige el resultado
Monitoreo de consumidores SQS
- 2
Definir el contrato
queue_name, message_id, receive_count y estado
- 3
Instrumentar el límite
Utilice metadatos de mensajes y atributos incluidos en la lista de permitidos; nunca envíe el cuerpo del mensaje.
- 4
Verificar la evidencia
Exercise a known fixture, then inspect queue_message_completed for one correctly typed terminal row.
Antes de empezar
Requisitos previos y límites
- Un TELEMETRY_API_KEY del lado del servidor
- Atributos de mensajes SQS para una correlación segura
- Una política documentada de fallas de lotes parciales
Configuración de entrega
Instalar e inicializar el lado del servidor
Importe telemetry-sh en código solo de servidor e inicialícelo una vez con Process.env.TELEMETRY_API_KEY. Mantenga las credenciales de ingesta fuera de los paquetes de navegador, las variables de entorno visibles para el cliente, el control de fuente, los registros y los mensajes de excepción.
Instalación npm
npm install telemetry-sh- 1Prepare un cliente de entrega del lado del servidor reutilizable con comportamiento de red limitado.
- 2Agregue el evento de resultado en el límite de éxito, error, reintento o tiempo de espera.
- 3Envíe accesorios controlados e inspeccione las filas almacenadas antes de habilitar una alerta.
Fragmento
Comience con un evento estructurado
Agregue esta forma donde el flujo de trabajo se completa, falla o se vuelve a intentar. Luego cree el panel a partir de campos reales.
Evento AWS SQS Queue Observability
await telemetry.log("queue_message_completed", {
queue_name: process.env.QUEUE_NAME,
message_id: record.messageId,
receive_count: Number(record.attributes.ApproximateReceiveCount),
message_age_ms: Date.now() - Number(record.attributes.SentTimestamp),
status: "success",
duration_ms: performance.now() - startedAt,
consumer: context.functionName,
});Contrato de evento
queue_name, message_id, receive_count y estado
message_age_ms, duration_ms, batch_size y error_type
consumidor, región, medio ambiente y lanzamiento
Puntos de control de implementación
Punto de control 1
Utilice metadatos de mensajes y atributos incluidos en la lista de permitidos; nunca envíe el cuerpo del mensaje.
Punto de control 2
Registre un resultado por mensaje cuando utilice respuestas por lotes parciales.
Punto de control 3
Separe el error de procesamiento de la redireccionación deliberada a una cola de mensajes fallidos.
Verificación
Demuestra que el evento llegó
Ejecute esto después de ejercitar casos conocidos de éxito y fracaso. Reemplace el nombre de la tabla alternativa si su contrato de evento final difiere del fragmento.
Consulta de verificación AWS SQS Queue Observability
SELECT *
FROM queue_message_completed
ORDER BY timestamp_utc DESC
LIMIT 20;Referencias de implementación
Revise el contrato del evento, la guía de seguridad de los datos y la documentación primaria previa antes de habilitar una nueva ruta de producción.
Límite de producción
Mantenga el evento de resultado pequeño y recuperable
Este patrón proporciona
- Un resultado limitado y listo para SQL junto al flujo de trabajo ascendente.
- Campos estables para paneles, alertas y correlación entre eventos.
- Una ruta basada en dispositivos para validar el comportamiento de éxito, fracaso, reintento y tiempo de espera.
Este patrón no proporciona
- Un exportador de OTLP, un canal de recopilación automática o un reemplazo para seguimientos detallados y registros de diagnóstico.
- Entrega exactamente una vez simplemente porque la carga útil contiene un ID de evento.
- Permiso para recopilar cargas útiles sin procesar del proveedor, contenido de usuario, credenciales o datos regulados.
Puntos de partida del esquema de eventos
Contratos de eventos para este flujo de trabajo
Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.
Función relacionada del producto
Continúe este flujo de trabajo en Alertas
Promueva la consulta de confiabilidad revisada a un umbral propio y un flujo de trabajo de respuesta.
Recetas SQL relacionadas
Responde la siguiente pregunta con SQL
Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.
Medir el tiempo de espera de la cola por trabajo
¿Qué trabajos esperan más tiempo antes de que un trabajador los inicie?
Receta abiertaEncuentre trabajos en segundo plano estancados con SQL
¿Qué trabajos comenzaron pero nunca produjeron un evento terminal?
Receta abiertaMedir el crecimiento de la cola de mensajes fallidos
¿Qué colas agregan trabajos fallidos más rápido de lo que los resuelven?
Receta abiertaExplorar por familia de implementación
Comparar patrones de integración relacionados
Plantillas para combinar con esta integración
Más integraciones
Trabajo de Sidekiq Telemetry
Realice un seguimiento de los resultados de ejecución, los intentos, las colas de espera, los errores y las liberaciones de Sidekiq desde el middleware del servidor sin copiar los argumentos del trabajo.
abrir guiaTrabajo de Inngest y Trigger.dev Telemetry
Instrumente trabajadores asíncronos, trabajos programados, reintentos, fallas y eventos de mensajes no entregados con registros listos para SQL.
abrir guiaObservabilidad del flujo de trabajo temporal
Realice un seguimiento de los resultados del flujo de trabajo temporal, los reintentos de actividad, la latencia del inicio programado y los hitos comerciales sin registrar las cargas útiles del flujo de trabajo.
abrir guia