跳转到内容
Telemetry
集成指南

LiteLLM 网关和 SDK Telemetry

跨受控模型网关跟踪 LiteLLM 提供商路由、重试、回退、令牌使用、延迟、成本估算和可接受的结果。

审阅者 Telemetry产品团队 . 埋点合约、隐私边界和实施指南. 审查标准和所有权

有用于
  • 跨提供商 LLM 可靠性
  • 回退和重试分析
  • 模型-网关单位经济学
实施证据

LiteLLM Gateway and SDK Telemetry:从边界到验证行

在受控应用程序边界使用 LiteLLM Gateway and SDK Telemetry,保持事件契约较小,并在构建聚合视图之前验证已知结果。

  1. 1

    选择结果

    跨提供商 LLM 可靠性

  2. 2

    定义合同

    operation_id、功能、requested_model、response_model、提供商、路由和发布

  3. 3

    埋点边界

    包装器赋予应用程序最终产品结果的所有权; LiteLLM 回调可以用网关报告的成本和路由上下文对其进行补充。

  4. 4

    核实证据

    Exercise a known fixture, then inspect litellm_request_completed for one correctly typed terminal row.

开始之前

先决条件和界限

  • LiteLLM 和 telemetry-sh 在受信任的 Python 服务中初始化
  • 稳定的功能、路线、模型别名、提供商、团队和发布维度
  • 排除模型内容的经过审查的回调或包装器边界

交货设置

安装并初始化服务器端

使用服务器端密钥为每个进程初始化一次 Telemetry 同步代码或 TelemetryAsync 异步代码。 将摄取凭据保留在浏览器包、客户端可见的环境变量、源代码控制、日志和异常消息之外。

litellm-安装

pip安装

bash
python -m pip install telemetry-sh
  1. 1准备一个具有有限网络行为的可重用服务器端交付客户端。
  2. 2在成功、失败、重试或超时边界处添加结果事件。
  3. 3在启用警报之前发送受控装置并检查存储的行。

片段

从一个结构化事件开始

在工作流程完成、失败或重试的位置添加此形状。然后从真实的字段构建仪表板。

litellm

LiteLLM Gateway and SDK Telemetry事件

python
from time import perf_counter
from litellm import completion

def complete_with_outcome(messages, operation_id: str):
    started_at = perf_counter()
    status = "success"
    error_type = None
    response = None

    try:
        response = completion(
            model="openai/gpt-5.6",
            messages=messages,
        )
        return response
    except Exception as error:
        status = "failed"
        error_type = classify_gateway_error(error)
        raise
    finally:
        usage = getattr(response, "usage", None)
        telemetry.log("litellm_request_completed", {
            "operation_id": operation_id,
            "feature": "support_draft",
            "requested_model": "openai/gpt-5.6",
            "response_model": getattr(response, "model", None),
            "status": status,
            "error_type": error_type,
            "duration_ms": round((perf_counter() - started_at) * 1000),
            "input_tokens": getattr(usage, "prompt_tokens", 0),
            "output_tokens": getattr(usage, "completion_tokens", 0),
            "release": APP_RELEASE,
        })

活动合约

operation_id、功能、requested_model、response_model、提供商、路由和发布

状态、duration_ms、input_tokens、output_tokens、retry_count、fallback_used 和 error_type

estimated_cost_usd、pricing_version、已接受、cache_hit、account_id 以及批准后的环境

实施检查点

检查站 1

包装器赋予应用程序最终产品结果的所有权; LiteLLM 回调可以用网关报告的成本和路由上下文对其进行补充。

检查站 2

将请求的模型别名与提供者响应模型分开,以便后备行为保持可查询性。

检查站 3

请勿将消息、响应、工具负载、虚拟密钥、提供商凭证或不受限制的例外复制到 Telemetry 中。

验证

证明事件已到达

在演练已知的成功和失败案例后运行此命令。如果您的最终事件契约与代码片段不同,请替换后备表名称。

litellm-验证

LiteLLM Gateway and SDK Telemetry 验证查询

sql
SELECT *
FROM litellm_request_completed
ORDER BY timestamp_utc DESC
LIMIT 20;
确认每个逻辑结果的一个终端行,以及预期状态、标识符、单位和 UTC 时间。
检查推断的架构并验证重试不会更改字段类型或生成新的逻辑事件 ID。
在存储的字段中搜索凭据、原始有效负载、提示、私有内容和无限制的错误消息。
在将仪表板视为完整之前,请执行提供程序超时、摄取拒绝和进程关闭。

实施参考

在启用新的生产路径之前,请检查事件合同、数据安全指南和上游主要文档。

生产边界

保持结果事件小且可恢复

该模式提供了

  • 除了上游工作流程之外,还有一个有界的、SQL 就绪的结果。
  • 用于仪表板、警报和跨事件关联的稳定字段。
  • 用于验证成功、失败、重试和超时行为的夹具驱动路径。

该模式不提供

  • OTLP 导出器、自动收集管道或详细跟踪和诊断日志的替代品。
  • 仅因为有效负载包含事件 ID,所以仅传送一次。
  • 收集原始提供商有效负载、用户内容、凭证或受监管数据的权限。

事件架构起点

在将查询或代码片段适应生产之前,请检查行粒度、发出边界、所需类型、隐私类、示例有效负载和验证清单。

相关产品功能

继续此工作流程 AI代理监控

通过可审查的 SQL 连接智能体运行、工具使用、模型成本、质量和产品结果。

相关 SQL 查询示例

用 SQL 回答下一个问题

针对此工作流程中的结构化字段运行查询,检查示例结果,并将有用的答案转换为仪表板或警报。

浏览所有查询示例

按实施系列浏览

比较相关集成模式

与此集成配对的模板

更多集成