用例證據路徑
Infrastructure metrics with SQL:從實施到決策
完整的 infrastructure metrics with sql 測量迴圈連線一個擁有的工作流程、一個有界事件契約、一個受控裝置和一個有人可以採取行動的問題。
- 1
設定邊界
使用主機、容器、處理程序和環境標籤記錄指標快照。
- 2
捕捉結果
Begin with container_metric_recorded, disk_metric_recorded, system_metric_recorded and document the grain of each event.
- 3
證明行數
針對閾值違規、趨勢變化和心跳缺失發出警示。
- 4
做出決定
哪些容器或主機承受持續壓力?
代理提示
將其貼上到您的編碼代理中
更換 YOUR_API_KEY 註冊後,然後要求代理執行產品流程並驗證第一個事件。
代理提示
Infrastructure metrics with SQL 設定提示
text
使用 Telemetry 進行儀器基礎設施指標。
使用 /skill.md 和此 Telemetry API 金鑰:YOUR_API_KEY
請記錄容器、磁碟、系統、網路、處理程序和心跳指標。包括 host_name、container_name、environment、metric_name、metric_value、unit、threshold、status 和 observed_at。
建立 CPU、記憶體、磁碟、網路、處理程序執行狀況和丟失心跳的儀表板。新增針對持續違反閾值和丟失資料的警示。
請勿記錄機密、環境變數值、包含憑據的命令參數或原始處理程序有效負載。設定步驟
- 1使用主機、容器、處理程序和環境標籤記錄指標快照。
- 2保持指標名稱穩定並在欄位中放置高基數識別符號。
- 3建立 CPU、記憶體、磁碟、網路和處理程序執行狀況的儀表板。
- 4針對閾值違規、趨勢變化和心跳缺失發出警示。
要捕獲的事件
container_metric_recordeddisk_metric_recordedsystem_metric_recordednetwork_metric_recordedprocess_metric_recordedheartbeat_missing
由此解鎖的問題
- 哪些容器或主機承受持續壓力?
- 哪些流程與產品事件相關?
- 哪些主機已停止回報心跳,或磁碟空間即將耗盡?
事件結構描述範例
此工作流程的事件結構描述
在將查詢或程式碼片段適應生產之前,請檢查行粒度、發出邊界、所需型別、隱私類、範例有效負載和驗證清單。
相關產品功能
繼續此工作流程 警示
將經過審查的可靠性查詢提升到擁有的閾值和回應工作流程中。
相關 SQL 查詢範例
更多 SQL 範例
針對此工作流程中的結構化欄位執行查詢,檢查範例結果,並將有用的答案轉換為儀表板或警示。
基礎設施中級
查詢快取未命中和踩踏風險
哪些快取鍵模式將低命中率與併發後端工作結合在一起?
開啟查詢範例基礎設施高階
計算事件檢測和恢復時間
每項服務需要多長時間來檢測事件並從事件中恢復?
開啟查詢範例基礎設施入門
查詢主機和容器資源飽和度
哪些基礎設施來源持續受到資源限制?
開啟查詢範例結構化事件入門
檢測丟失的服務心跳
哪些預期遙測源已停止傳送心跳?
開啟查詢範例API 可靠性中級
計算 p50、p95 和 p99 API 延遲
哪些端點的尾部延遲最差?
開啟查詢範例API 可靠性入門
按路由計算API錯誤率
在至少有 20 次請求的 API 路由中,哪些路由的 5xx 錯誤率最高?
開啟查詢範例基礎設施入門
按工作負載查詢 Kubernetes 重啟情況
哪些 Kubernetes 工作負載正在重新啟動並且未透過就緒性檢查?
開啟查詢範例資料品質入門
按事件名稱測量 Telemetry 音量
哪些事件合約創造了最大的攝取量?
開啟查詢範例相關頁面