MCP Server and Tool Telemetry: del límite a la fila verificada
Utilice MCP Server and Tool Telemetry en un límite de aplicación controlado, mantenga el contrato de evento pequeño y verifique un resultado conocido antes de crear vistas agregadas.
- 1
Elige el resultado
Fiabilidad de la herramienta MCP
- 2
Definir el contrato
tool_call_id, run_id, server_name, tool_name, client_type, transporte y liberación
- 3
Instrumentar el límite
Instrumente el controlador de herramientas registrado para que cada intento de invocación produzca un evento de resultado, incluidos los errores de MCP devueltos.
- 4
Verificar la evidencia
Exercise a known fixture, then inspect mcp_tool_completed for one correctly typed terminal row.
Antes de empezar
Requisitos previos y límites
- @modelcontextprotocol/sdk, zod y telemetry-sh inicializados en un proceso de servidor confiable
- Una taxonomía de herramientas limitada y un identificador de ejecución o llamada propiedad de la aplicación
- Una política de autorización y privacidad para entradas, salidas, aprobaciones, identidad del cliente y efectos secundarios de herramientas.
Configuración de entrega
Instalar e inicializar el lado del servidor
Importe telemetry-sh en código solo de servidor e inicialícelo una vez con Process.env.TELEMETRY_API_KEY. Mantenga las credenciales de ingesta fuera de los paquetes de navegador, las variables de entorno visibles para el cliente, el control de fuente, los registros y los mensajes de excepción.
Instalación npm
npm install telemetry-sh- 1Prepare un cliente de entrega del lado del servidor reutilizable con comportamiento de red limitado.
- 2Agregue el evento de resultado en el límite de éxito, error, reintento o tiempo de espera.
- 3Envíe accesorios controlados e inspeccione las filas almacenadas antes de habilitar una alerta.
Fragmento
Comience con un evento estructurado
Agregue esta forma donde el flujo de trabajo se completa, falla o se vuelve a intentar. Luego cree el panel a partir de campos reales.
Evento MCP Server and Tool Telemetry
server.registerTool(
"lookup-account",
{
title: "Look up account",
description: "Return an approved account summary",
inputSchema: { accountId: z.string() },
},
async ({ accountId }) => {
const startedAt = performance.now();
const toolCallId = crypto.randomUUID();
let status = "success";
let errorType;
try {
const summary = await lookupApprovedAccountSummary(accountId);
return {
content: [{ type: "text", text: summary }],
};
} catch (error) {
status = "failed";
errorType = classifyToolError(error);
return {
content: [{ type: "text", text: "Account lookup failed" }],
isError: true,
};
} finally {
await telemetry.log("mcp_tool_completed", {
tool_call_id: toolCallId,
server_name: "account-tools",
tool_name: "lookup-account",
status,
error_type: errorType,
duration_ms: Math.round(performance.now() - startedAt),
release: process.env.APP_RELEASE,
}).catch(reportTelemetryDeliveryFailure);
}
},
);Contrato de evento
tool_call_id, run_id, server_name, tool_name, client_type, transporte y liberación
estado, duration_ms, retry_count, error_type, approval_required y approval_result
side_effect_category y output_category solo cuando estén delimitados y aprobados
Puntos de control de implementación
Punto de control 1
Instrumente el controlador de herramientas registrado para que cada intento de invocación produzca un evento de resultado, incluidos los errores de MCP devueltos.
Punto de control 2
Mantenga las entradas de herramientas, el contenido devuelto, los recursos integrados, las rutas de archivos, las credenciales, los tokens y los errores sin restricciones fuera de Telemetry de forma predeterminada.
Punto de control 3
No permita que la falla en la entrega de Telemetry cambie el resultado exitoso de la herramienta; utilice un tiempo de espera breve, informes de errores locales y un comportamiento de apagado limitado.
Verificación
Demuestra que el evento llegó
Ejecute esto después de ejercitar casos conocidos de éxito y fracaso. Reemplace el nombre de la tabla alternativa si su contrato de evento final difiere del fragmento.
Consulta de verificación MCP Server and Tool Telemetry
SELECT *
FROM mcp_tool_completed
ORDER BY timestamp_utc DESC
LIMIT 20;Referencias de implementación
Revise el contrato del evento, la guía de seguridad de los datos y la documentación primaria previa antes de habilitar una nueva ruta de producción.
Límite de producción
Mantenga el evento de resultado pequeño y recuperable
Este patrón proporciona
- Un resultado limitado y listo para SQL junto al flujo de trabajo ascendente.
- Campos estables para paneles, alertas y correlación entre eventos.
- Una ruta basada en dispositivos para validar el comportamiento de éxito, fracaso, reintento y tiempo de espera.
Este patrón no proporciona
- Un exportador de OTLP, un canal de recopilación automática o un reemplazo para seguimientos detallados y registros de diagnóstico.
- Entrega exactamente una vez simplemente porque la carga útil contiene un ID de evento.
- Permiso para recopilar cargas útiles sin procesar del proveedor, contenido de usuario, credenciales o datos regulados.
Puntos de partida del esquema de eventos
Contratos de eventos para este flujo de trabajo
Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.
agent_tool_authorization_decided
Una decisión de autorización final por intento de llamada de herramienta lógica.
inspeccionar contratoagent_tool_call_completed
Un intento de llamada a herramienta completado dentro de una ejecución de agente.
inspeccionar contratoFunción relacionada del producto
Continúe este flujo de trabajo en Monitoreo de agentes de IA
Conecte las ejecuciones de agentes, el uso de herramientas, el costo del modelo, la calidad y los resultados del producto con SQL revisable.
Recetas SQL relacionadas
Responde la siguiente pregunta con SQL
Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.
Auditar las decisiones de autorización de la herramienta del agente de IA
¿Qué herramientas de agentes se niegan o se envían a la aprobación humana con mayor frecuencia?
Receta abiertaConsultar eventos de llamadas de herramientas de IA anidadas
¿Qué herramientas y argumentos de IA están asociados con la mayor cantidad de llamadas fallidas?
Receta abiertaDetectar bucles repetidos de herramientas de agentes de IA
¿Qué ejecuciones de agentes aparecen atrapadas en un bucle de herramientas repetitivo?
Receta abiertaReconstruir una línea de tiempo de flujo de trabajo correlacionado
¿Qué sucedió, en orden, durante el último flujo de trabajo fallido?
Receta abiertaAuditar acciones privilegiadas con SQL
¿Qué acciones privilegiadas fallan o requieren revisión humana con mayor frecuencia?
Receta abiertaExplorar por familia de implementación
Comparar patrones de integración relacionados
Plantillas para combinar con esta integración
Plantilla de auditoría de seguridad del agente de IA
Instrumente decisiones de autorización de herramientas, versiones de políticas, aprobaciones humanas y resultados de terminales con eventos estructurados seguros para la privacidad.
Abrir plantillaPlantilla de observabilidad de agentes de IA
Realice un seguimiento de las ejecuciones de agentes, llamadas de herramientas, reintentos, latencia de modelos, errores y resultados aceptados con eventos estructurados listos para SQL.
Abrir plantillaMás integraciones
OpenAI Agente Telemetry
Registre las ejecuciones del agente OpenAI, las llamadas a herramientas, el uso del modelo, la latencia, el costo y los resultados finales con eventos estructurados.
abrir guiaMonitoreo de tiempo de espera, estado y flujo de tareas de AutoGen
Realice un seguimiento del estado del flujo de tareas de AutoGen, los tiempos de espera, los resultados del equipo y de los agentes, la actividad de las herramientas, las transferencias, la latencia, las fallas, los costos y las versiones con eventos estructurados compactos.
abrir guiaFlujo de trabajo de CrewAI Telemetry
Realice un seguimiento de los resultados del flujo y del equipo de CrewAI, el recuento de tareas, las transferencias, los reintentos, la latencia, el costo y los resultados aceptados sin retener las conversaciones de los agentes.
abrir guia