用例证据路径
Infrastructure metrics with SQL:从实施到决策
完整的 infrastructure metrics with sql 测量循环连接一个拥有的工作流程、一个有界事件契约、一个受控装置和一个有人可以采取行动的问题。
- 1
设定边界
使用主机、容器、进程和环境标签记录指标快照。
- 2
捕捉结果
Begin with container_metric_recorded, disk_metric_recorded, system_metric_recorded and document the grain of each event.
- 3
证明行数
针对阈值违规、趋势变化和心跳缺失发出警报。
- 4
做出决定
哪些容器或主机承受持续压力?
代理提示
将其粘贴到您的编码代理中
更换 YOUR_API_KEY 注册后,然后要求智能体运行产品流程并验证第一个事件。
代理提示
Infrastructure metrics with SQL 设置提示
text
使用 Telemetry 进行仪器基础设施指标。
使用 /skill.md 和此 Telemetry API 密钥:YOUR_API_KEY
请记录容器、磁盘、系统、网络、进程和心跳指标。包括 host_name、container_name、environment、metric_name、metric_value、unit、threshold、status 和 observed_at。
创建 CPU、内存、磁盘、网络、进程运行状况和丢失心跳的仪表板。添加针对持续违反阈值和丢失数据的警报。
请勿记录机密、环境变量值、包含凭据的命令参数或原始进程有效负载。设置步骤
- 1使用主机、容器、进程和环境标签记录指标快照。
- 2保持指标名称稳定并在字段中放置高基数标识符。
- 3创建 CPU、内存、磁盘、网络和进程运行状况的仪表板。
- 4针对阈值违规、趋势变化和心跳缺失发出警报。
要捕获的事件
container_metric_recordeddisk_metric_recordedsystem_metric_recordednetwork_metric_recordedprocess_metric_recordedheartbeat_missing
由此解锁的问题
- 哪些容器或主机承受持续压力?
- 哪些流程与产品事件相关?
- 哪些主机已停止报告心跳,或磁盘空间即将耗尽?
事件模式示例
此工作流的事件模式
在将查询或代码片段适应生产之前,请检查行粒度、发出边界、所需类型、隐私类、示例有效负载和验证清单。
相关产品功能
继续此工作流程 告警
将经过审查的可靠性查询提升到拥有的阈值和响应工作流程中。
相关 SQL 查询示例
更多 SQL 示例
针对此工作流程中的结构化字段运行查询,检查示例结果,并将有用的答案转换为仪表板或警报。
基础设施中级
查找缓存未命中和踩踏风险
哪些缓存键模式将低命中率与并发后端工作结合在一起?
打开查询示例基础设施高级
计算事件检测和恢复时间
每项服务需要多长时间来检测事件并从事件中恢复?
打开查询示例基础设施入门
查找主机和容器资源饱和度
哪些基础设施来源持续受到资源限制?
打开查询示例结构化事件入门
检测丢失的服务心跳
哪些预期遥测源已停止发送心跳?
打开查询示例API 可靠性中级
计算 p50、p95 和 p99 API 延迟
哪些端点的尾部延迟最差?
打开查询示例API 可靠性入门
按路由计算API错误率
在至少有 20 次请求的 API 路由中,哪些路由的 5xx 错误率最高?
打开查询示例基础设施入门
按工作负载查找 Kubernetes 重启情况
哪些 Kubernetes 工作负载正在重新启动并且未通过就绪性检查?
打开查询示例数据质量入门
按事件名称测量 Telemetry 音量
哪些事件合约创造了最大的摄取量?
打开查询示例相关页面