API error and latency monitor: implementación a decisión
Trate el mensaje como un resumen de implementación. El artefacto útil no es sólo el código copiado, sino un contrato de evento revisado que produce una respuesta confiable.
- 1
Establecer el límite
Instrument the point where api_request_started becomes final.
- 2
crear el contrato
Start with api_request_started, api_request_completed, api_request_failed and keep every field typed, bounded, and privacy-reviewed.
- 3
ejecutar un dispositivo
Pruebe casos conocidos de éxito, fracaso, reintento y resultados vacíos antes de confiar en resultados agregados.
- 4
Responde la pregunta
¿Qué rutas son más lentas según la latencia p95?
Plantilla versus caso de uso
Usa esta plantilla para añadir eventos
Copie esta plantilla cuando el objetivo de medición ya esté claro. Utilice la guía de casos de uso correspondientes para revisar los límites de los eventos, las definiciones de éxito y las decisiones que debe admitir el SQL resultante.
Plantilla
Pega esto en tu agente de codificación
Reemplazar YOUR_API_KEY, ejecute el flujo localmente y luego verifique los eventos y paneles generados.
Monitor de latencia y errores de API
Agregue Telemetry al manejo de solicitudes de API.
Utilice /skill.md y esta clave API Telemetry: YOUR_API_KEY
Registre cada solicitud API importante con:
route_template, method, status_code, status, latency_ms, user_id, team_id, request_size_bytes, response_size_bytes, error_type y feature.
Cree gráficos para el volumen de solicitudes, la tasa de errores, la latencia p50, la latencia p95 y los principales puntos finales con fallas. Agregue alertas para picos de 5xx, latencia p95 lenta y caídas de tráfico.
No registre cuerpos de solicitudes, cookies, encabezados de autenticación, secretos ni contenido de usuario sin procesar.Eventos para capturar
Lista de verificación de verificación
Lo que deja un pase completo de instrumentación
Eventos
Los eventos sintéticos llegan a la tabla deseada con nombres y tipos de campos estables.
Consultas
Las primeras consultas SQL devuelven filas plausibles con una ventana de tiempo explícita.
Vistas
Un panel utiliza los campos reales e incluye suficiente contexto para explicar un cambio.
Seguridad
Se verificaron las indicaciones, cuerpos, credenciales, firmas y contenido privado para su redacción.
Ejemplos de esquemas de eventos
Esquemas de eventos para este flujo de trabajo
Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.
Función relacionada del producto
Continúe este flujo de trabajo en Alertas
Promueva la consulta de confiabilidad revisada a un umbral propio y un flujo de trabajo de respuesta.
Recetas SQL relacionadas
Más ejemplos de SQL
Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.
Calcular el rendimiento de las solicitudes de API por ruta
¿Qué rutas API procesan la mayor cantidad de solicitudes por minuto?
Receta abiertaMedir la recuperación del límite de velocidad API 429
¿Las solicitudes que reciben HTTP 429 se recuperan correctamente después de volver a intentarlo?
Receta abiertaCalcular el tiempo de detección y recuperación de incidentes
¿Cuánto tiempo tarda cada servicio en detectar y recuperarse de incidentes?
Receta abiertaCalcular la tasa de errores de API por ruta
¿Qué rutas de API tienen la mayor tasa de errores 5xx con al menos 20 solicitudes?
Receta abiertaCalcule la latencia API p50, p95 y p99
¿Qué puntos finales tienen la peor latencia de cola?
Receta abiertaCalcular la tasa de tiempo de espera de API por ruta
¿Qué rutas API caducan con suficiente frecuencia como para afectar a los usuarios?
Receta abiertaComparar dependencia p95 Latencia
¿Qué dependencias posteriores tienen la peor latencia de cola y tasa de fallas?
Receta abiertaMedir la disponibilidad de API frente a un SLO
¿Cada servicio cumplió con su objetivo de disponibilidad diaria?
Receta abiertaCalcular la tasa de consumo de presupuesto de errores de API
¿Con qué rapidez está consumiendo la API su presupuesto de disponibilidad del 99,9 %?
Receta abiertaClasificación de huellas dactilares de error por impacto en el cliente
¿Qué grupos de errores afectan a la mayoría de las cuentas de clientes?
Receta abiertaComparar la tasa de errores de implementación de funciones
¿Es el lanzamiento de banderas de características menos confiable que su cohorte de control?
Receta abiertaMedir el impacto del incidente en el cliente por plan
¿Cuántas cuentas se vieron afectadas por el incidente en cada plan?
Receta abiertaMás plantillas