Saltar al contenido
Telemetry
guía de integración

API de respuestas OpenAI Telemetry

Mida la latencia de la API de OpenAI Responses, el uso de tokens, la actividad de las herramientas, las fallas y los resultados posteriores sin recopilar indicaciones ni contenido generado.

Revisado por el equipo de producto Telemetry en . Contrato de instrumentación, límites de privacidad y guía de implementación. Revisar los estándares y la propiedad

Útil para
  • Análisis de latencia y costos de API de Responses
  • Fiabilidad del modelo y las características
  • Medición de resultados y aceptación de la IA
Evidencia de implementación

OpenAI Responses API Telemetry: del límite a la fila verificada

Utilice OpenAI Responses API Telemetry en un límite de aplicación controlado, mantenga el contrato de evento pequeño y verifique un resultado conocido antes de crear vistas agregadas.

  1. 1

    Elige el resultado

    Análisis de latencia y costos de API de Responses

  2. 2

    Definir el contrato

    operation_id, response_id, función, flujo de trabajo, proveedor, modelo y versión

  3. 3

    Instrumentar el límite

    Envuelva la llamada API de Responses propiedad de la aplicación y emita un evento de solicitud de terminal después de que se conozca el uso y el resultado.

  4. 4

    Verificar la evidencia

    Exercise a known fixture, then inspect openai_response_completed for one correctly typed terminal row.

Antes de empezar

Requisitos previos y límites

  • El SDK oficial OpenAI JavaScript y telemetry-sh inicializados en código de servidor confiable
  • Un ID de operación propiedad de la aplicación más características estables, flujo de trabajo, alias de modelo y nombres de versiones.
  • Una política revisada para datos de avisos, respuestas, herramientas e identificadores.

Configuración de entrega

Instalar e inicializar el lado del servidor

Importe telemetry-sh en código solo de servidor e inicialícelo una vez con Process.env.TELEMETRY_API_KEY. Mantenga las credenciales de ingesta fuera de los paquetes de navegador, las variables de entorno visibles para el cliente, el control de fuente, los registros y los mensajes de excepción.

Instalación de openai-responses-api

Instalación npm

bash
npm install telemetry-sh
  1. 1Prepare un cliente de entrega del lado del servidor reutilizable con comportamiento de red limitado.
  2. 2Agregue el evento de resultado en el límite de éxito, error, reintento o tiempo de espera.
  3. 3Envíe accesorios controlados e inspeccione las filas almacenadas antes de habilitar una alerta.

Fragmento

Comience con un evento estructurado

Agregue esta forma donde el flujo de trabajo se completa, falla o se vuelve a intentar. Luego cree el panel a partir de campos reales.

openai-responses-api

Evento OpenAI Responses API Telemetry

javascript
import OpenAI from "openai";
import { Telemetry } from "telemetry-sh";

const openai = new OpenAI();
const telemetry = new Telemetry(process.env.TELEMETRY_API_KEY);

const startedAt = performance.now();
let response;
let status = "success";
let errorType;

try {
  response = await openai.responses.create({
    model: process.env.OPENAI_MODEL ?? "gpt-5.6",
    input: approvedInput,
  });
  return response.output_text;
} catch (error) {
  status = "failed";
  errorType = classifyOpenAIError(error);
  throw error;
} finally {
  await telemetry.log("openai_response_completed", {
    operation_id: operationId,
    response_id: response?.id,
    feature: "support_draft",
    provider: "openai",
    model: response?.model ?? process.env.OPENAI_MODEL ?? "gpt-5.6",
    status,
    error_type: errorType,
    duration_ms: Math.round(performance.now() - startedAt),
    input_tokens: response?.usage?.input_tokens ?? 0,
    output_tokens: response?.usage?.output_tokens ?? 0,
    total_tokens: response?.usage?.total_tokens ?? 0,
    release: process.env.APP_RELEASE,
  });
}

Contrato de evento

operation_id, response_id, función, flujo de trabajo, proveedor, modelo y versión

estado, duration_ms, input_tokens, output_tokens, total_tokens, retry_count y error_type

tool_call_count, aceptado, human_handoff, estimated_cost_usd y pricing_version cuando estén aprobados

Puntos de control de implementación

Punto de control 1

Envuelva la llamada API de Responses propiedad de la aplicación y emita un evento de solicitud de terminal después de que se conozca el uso y el resultado.

Punto de control 2

El uso del proveedor admite la contabilidad de tokens, pero el costo es una estimación propiedad de la aplicación que necesita una fuente de precios fechada y una conciliación separada.

Punto de control 3

Mantenga las indicaciones, los resultados generados, los argumentos de las herramientas, los resultados de las herramientas, las claves API y los mensajes de excepción sin restricciones fuera del evento de forma predeterminada.

Verificación

Demuestra que el evento llegó

Ejecute esto después de ejercitar casos conocidos de éxito y fracaso. Reemplace el nombre de la tabla alternativa si su contrato de evento final difiere del fragmento.

Verificación openai-responses-api

Consulta de verificación OpenAI Responses API Telemetry

sql
SELECT *
FROM openai_response_completed
ORDER BY timestamp_utc DESC
LIMIT 20;
Confirme una fila terminal por resultado lógico, con el estado esperado, identificadores, unidades y hora UTC.
Inspeccione el esquema inferido y verifique que los reintentos no cambien los tipos de campos ni generen un nuevo ID de evento lógico.
Busque en los campos almacenados credenciales, cargas útiles sin procesar, mensajes, contenido privado y mensajes de error ilimitados.
Realice un tiempo de espera del proveedor, un rechazo de la ingesta y un cierre del proceso antes de considerar el panel como completo.

Referencias de implementación

Revise el contrato del evento, la guía de seguridad de los datos y la documentación primaria previa antes de habilitar una nueva ruta de producción.

Límite de producción

Mantenga el evento de resultado pequeño y recuperable

Este patrón proporciona

  • Un resultado limitado y listo para SQL junto al flujo de trabajo ascendente.
  • Campos estables para paneles, alertas y correlación entre eventos.
  • Una ruta basada en dispositivos para validar el comportamiento de éxito, fracaso, reintento y tiempo de espera.

Este patrón no proporciona

  • Un exportador de OTLP, un canal de recopilación automática o un reemplazo para seguimientos detallados y registros de diagnóstico.
  • Entrega exactamente una vez simplemente porque la carga útil contiene un ID de evento.
  • Permiso para recopilar cargas útiles sin procesar del proveedor, contenido de usuario, credenciales o datos regulados.

Puntos de partida del esquema de eventos

Revise el detalle de la fila, el límite de emisión, los tipos requeridos, las clases de privacidad, la carga útil de ejemplo y la lista de verificación de validación antes de adaptar una consulta o fragmento a producción.

Función relacionada del producto

Continúe este flujo de trabajo en Monitoreo de agentes de IA

Conecte las ejecuciones de agentes, el uso de herramientas, el costo del modelo, la calidad y los resultados del producto con SQL revisable.

Recetas SQL relacionadas

Responde la siguiente pregunta con SQL

Ejecute la consulta en los campos estructurados de este flujo de trabajo, inspeccione el resultado del ejemplo y convierta una respuesta útil en un panel o alerta.

Explorar todas las recetas
colecciones completasIA y LLM SQL

Explorar por familia de implementación

Comparar patrones de integración relacionados

Plantillas para combinar con esta integración

Más integraciones