Kubernetes Workload Telemetry: del límite a la fila verificada
Utilice Kubernetes Workload Telemetry en un límite de aplicación controlado, mantenga el contrato de evento pequeño y verifique un resultado conocido antes de crear vistas agregadas.
- 1
Elige el resultado
Análisis de reinicio de contenedores
- 2
Definir el contrato
clúster, espacio de nombres, carga de trabajo, pod, event_name y entorno
- 3
Instrumentar el límite
Resuelva cada pod en su propietario de implementación, StatefulSet, DaemonSet o trabajo antes de generar informes para que los paneles no se fragmenten en nombres de pods de corta duración.
- 4
Verificar la evidencia
Exercise a known fixture, then inspect kubernetes_workload_event for one correctly typed terminal row.
Antes de empezar
Requisitos previos y límites
- Un recopilador o controlador con acceso de solo lectura a los campos de estado de la carga de trabajo dentro del alcance.
- Clúster estable, espacio de nombres, propietario de carga de trabajo y etiquetas de lanzamiento de aplicaciones
- Una política de redacción que excluye secretos, manifiestos, valores ambientales, registros sin procesar y cargas útiles de clientes.
Configuración de entrega
Instalar e inicializar el lado del servidor
Importe telemetry-sh en código solo de servidor e inicialícelo una vez con Process.env.TELEMETRY_API_KEY. Mantenga las credenciales de ingesta fuera de los paquetes de navegador, las variables de entorno visibles para el cliente, el control de fuente, los registros y los mensajes de excepción.
Instalación npm
npm install telemetry-sh- 1Prepare un cliente de entrega del lado del servidor reutilizable con comportamiento de red limitado.
- 2Agregue el evento de resultado en el límite de éxito, error, reintento o tiempo de espera.
- 3Envíe accesorios controlados e inspeccione las filas almacenadas antes de habilitar una alerta.
Fragmento
Comience con un evento estructurado
Agregue esta forma donde el flujo de trabajo se completa, falla o se vuelve a intentar. Luego cree el panel a partir de campos reales.
Evento Kubernetes Workload Telemetry
import telemetry from "telemetry-sh";
export async function logKubernetesWorkloadSample({
cluster,
namespace,
workload,
pod,
restartCount,
ready,
applicationRelease,
previousRestartCount,
}) {
const eventName =
restartCount > previousRestartCount
? "container_restarted"
: "workload_sampled";
await telemetry.log("kubernetes_workload_event", {
cluster,
namespace,
workload,
pod,
event_name: eventName,
restart_count: restartCount,
ready,
application_release: applicationRelease,
environment: "production",
});
}Contrato de evento
clúster, espacio de nombres, carga de trabajo, pod, event_name y entorno
restart_count, listo, rollout_id, application_release y observed_generation
Una categoría de motivo limitada solo cuando se aprueba la recopilación del valor de origen
Puntos de control de implementación
Punto de control 1
Resuelva cada pod en su propietario de implementación, StatefulSet, DaemonSet o trabajo antes de generar informes para que los paneles no se fragmenten en nombres de pods de corta duración.
Punto de control 2
Emite una transición container_restarted cuando aumenta el contador acumulativo; mantenga el contador como contexto y nunca sume muestras de calibre.
Punto de control 3
Correlacione los reinicios repetidos con la pérdida sostenida de preparación y los resultados de la aplicación antes de la paginación.
Verificación
Demuestra que el evento llegó
Ejecute esto después de ejercitar casos conocidos de éxito y fracaso. Reemplace el nombre de la tabla alternativa si su contrato de evento final difiere del fragmento.
Consulta de verificación Kubernetes Workload Telemetry
SELECT *
FROM kubernetes_workload_event
ORDER BY timestamp_utc DESC
LIMIT 20;Referencias de implementación
Revise el contrato del evento, la guía de seguridad de los datos y la documentación primaria previa antes de habilitar una nueva ruta de producción.
Límite de producción
Mantenga el evento de resultado pequeño y recuperable
Este patrón proporciona
- Un resultado limitado y listo para SQL junto al flujo de trabajo ascendente.
- Campos estables para paneles, alertas y correlación entre eventos.
- Una ruta basada en dispositivos para validar el comportamiento de éxito, fracaso, reintento y tiempo de espera.
Este patrón no proporciona
- Un exportador de OTLP, un canal de recopilación automática o un reemplazo para seguimientos detallados y registros de diagnóstico.
- Entrega exactamente una vez simplemente porque la carga útil contiene un ID de evento.
- Permiso para recopilar cargas útiles sin procesar del proveedor, contenido de usuario, credenciales o datos regulados.
Puntos de partida del esquema de eventos
Contratos de eventos para este flujo de trabajo
Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.
Función relacionada del producto
Continúe este flujo de trabajo en Alertas
Promueva la consulta de confiabilidad revisada a un umbral propio y un flujo de trabajo de respuesta.
Recetas SQL relacionadas
Responde la siguiente pregunta con SQL
Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.
Encuentre reinicios de Kubernetes por carga de trabajo
¿Qué cargas de trabajo de Kubernetes se reinician y no superan las comprobaciones de preparación?
Receta abiertaEncuentre la saturación de recursos de host y contenedor
¿Qué fuentes de infraestructura tienen recursos persistentemente limitados?
Receta abiertaCalcular el tiempo de detección y recuperación de incidentes
¿Cuánto tiempo tarda cada servicio en detectar y recuperarse de incidentes?
Receta abiertaDetectar latidos de servicio faltantes
¿Qué fuentes de telemetría esperadas han dejado de enviar latidos?
Receta abiertaExplorar por familia de implementación
Comparar patrones de integración relacionados
Plantillas para combinar con esta integración
Más integraciones
Integración de AWS ECS y Fargate Telemetry
Agregue la familia de tareas de ECS, la revisión, la zona de disponibilidad y el contexto de lanzamiento a los resultados de la aplicación utilizando el punto final de metadatos de la tarea local.
abrir guiaFlujo de trabajo n8n Telemetry
Envíe los resultados de finalización, error, reintento, recuento de elementos y entrega posterior del flujo de trabajo n8n a un evento Telemetry limitado a través del nodo de solicitud HTTP.
abrir guiaMonitoreo de eventos estructurados de AWS Lambda
Realice un seguimiento de las invocaciones de Lambda, los arranques en frío, la duración, los reintentos y los resultados comerciales con eventos estructurados compactos.
abrir guia