跳转到内容
Telemetry
集成指南

Kubernetes 工作负载 Telemetry

将有界 Kubernetes 重启、准备情况和部署观察结果发送到 Telemetry 以进行工作负载级 SQL 分析。

审阅者 Telemetry产品团队 . 埋点合约、隐私边界和实施指南. 审查标准和所有权

有用于
  • 容器重启分析
  • 准备情况和部署监控
  • 工作负载与应用程序事件关联
实施证据

Kubernetes Workload Telemetry:从边界到验证行

在受控应用程序边界使用 Kubernetes Workload Telemetry,保持事件契约较小,并在构建聚合视图之前验证已知结果。

  1. 1

    选择结果

    容器重启分析

  2. 2

    定义合同

    集群、命名空间、工作负载、pod、event_name 和环境

  3. 3

    埋点边界

    在报告之前将每个 Pod 解析为其 Deployment、StatefulSet、DaemonSet 或 Job 所有者,以便仪表板不会因短期 Pod 名称而产生碎片。

  4. 4

    核实证据

    Exercise a known fixture, then inspect kubernetes_workload_event for one correctly typed terminal row.

开始之前

先决条件和界限

  • 对范围内的工作负载状态字段具有只读访问权限的收集器或控制器
  • 稳定的集群、命名空间、工作负载所有者和应用程序发布标签
  • 排除机密、清单、环境值、原始日志和客户负载的编辑策略

交货设置

安装并初始化服务器端

在仅服务器代码中导入 telemetry-sh 并使用 process.env.TELEMETRY_API_KEY 对其进行一次初始化。 将摄取凭据保留在浏览器包、客户端可见的环境变量、源代码控制、日志和异常消息之外。

kubernetes-安装

npm安装

bash
npm install telemetry-sh
  1. 1准备一个具有有限网络行为的可重用服务器端交付客户端。
  2. 2在成功、失败、重试或超时边界处添加结果事件。
  3. 3在启用警报之前发送受控装置并检查存储的行。

片段

从一个结构化事件开始

在工作流程完成、失败或重试的位置添加此形状。然后从真实的字段构建仪表板。

kubernetes

Kubernetes Workload Telemetry事件

javascript
import telemetry from "telemetry-sh";

export async function logKubernetesWorkloadSample({
  cluster,
  namespace,
  workload,
  pod,
  restartCount,
  ready,
  applicationRelease,
  previousRestartCount,
}) {
  const eventName =
    restartCount > previousRestartCount
      ? "container_restarted"
      : "workload_sampled";

  await telemetry.log("kubernetes_workload_event", {
    cluster,
    namespace,
    workload,
    pod,
    event_name: eventName,
    restart_count: restartCount,
    ready,
    application_release: applicationRelease,
    environment: "production",
  });
}

活动合约

集群、命名空间、工作负载、pod、event_name 和环境

restart_count、就绪、rollout_id、application_release 和 observed_generation

仅当源值被批准收集时才是有限原因类别

实施检查点

检查站 1

在报告之前将每个 Pod 解析为其 Deployment、StatefulSet、DaemonSet 或 Job 所有者,以便仪表板不会因短期 Pod 名称而产生碎片。

检查站 2

当累积计数器增加时发出 container_restarted 转换;将计数器作为上下文,切勿对仪表样本求和。

检查站 3

将重复重启与寻呼前的持续准备状态损失和应用程序结果关联起来。

验证

证明事件已到达

在演练已知的成功和失败案例后运行此命令。如果您的最终事件契约与代码片段不同,请替换后备表名称。

kubernetes-验证

Kubernetes Workload Telemetry 验证查询

sql
SELECT *
FROM kubernetes_workload_event
ORDER BY timestamp_utc DESC
LIMIT 20;
确认每个逻辑结果的一个终端行,以及预期状态、标识符、单位和 UTC 时间。
检查推断的架构并验证重试不会更改字段类型或生成新的逻辑事件 ID。
在存储的字段中搜索凭据、原始有效负载、提示、私有内容和无限制的错误消息。
在将仪表板视为完整之前,请执行提供程序超时、摄取拒绝和进程关闭。

实施参考

在启用新的生产路径之前,请检查事件合同、数据安全指南和上游主要文档。

生产边界

保持结果事件小且可恢复

该模式提供了

  • 除了上游工作流程之外,还有一个有界的、SQL 就绪的结果。
  • 用于仪表板、警报和跨事件关联的稳定字段。
  • 用于验证成功、失败、重试和超时行为的夹具驱动路径。

该模式不提供

  • OTLP 导出器、自动收集管道或详细跟踪和诊断日志的替代品。
  • 仅因为有效负载包含事件 ID,所以仅传送一次。
  • 收集原始提供商有效负载、用户内容、凭证或受监管数据的权限。

事件架构起点

在将查询或代码片段适应生产之前,请检查行粒度、发出边界、所需类型、隐私类、示例有效负载和验证清单。

相关产品功能

继续此工作流程 告警

将经过审查的可靠性查询提升到拥有的阈值和响应工作流程中。

相关 SQL 查询示例

用 SQL 回答下一个问题

针对此工作流程中的结构化字段运行查询,检查示例结果,并将有用的答案转换为仪表板或警报。

浏览所有查询示例

按实施系列浏览

比较相关集成模式

与此集成配对的模板

更多集成