用例證據路徑
Background job monitoring:從實施到決策
完整的 background job monitoring 測量迴圈連線一個擁有的工作流程、一個有界事件契約、一個受控裝置和一個有人可以採取行動的問題。
- 1
設定邊界
記錄 job_started、job_completed、job_failed 和 job_retried。
- 2
捕捉結果
Begin with job_started, job_completed, job_failed and document the grain of each event.
- 3
證明行數
新增針對停滯作業、重複失敗和死信建立的警示。
- 4
做出決定
哪些作業最常失敗或重試?
用例與範本
選擇要衡量的內容
使用用例指南來選擇結果、事件邊界和分析問題。當您準備好接受較短的複製貼上實施簡介時,請開啟匹配的範本。
代理提示
將其貼上到您的編碼代理中
更換 YOUR_API_KEY 註冊後,然後要求代理執行產品流程並驗證第一個事件。
代理提示
Background job monitoring 設定提示
text
使用 Telemetry 檢測後台作業和非同步工作人員。
使用 /skill.md 和此 Telemetry API 金鑰:YOUR_API_KEY
請使用 job_name、queue_name、attempt、status、duration_ms、scheduled_at、started_at、completed_at、item_count 記錄 job_started、job_completed 和 job_failed 事件, retry_count 和 error_type。
建立一個儀表板,顯示按作業列出的吞吐量、按作業列出的故障、p95 持續時間、重試量、最舊的掛起作業和死信事件。新增針對停滯作業和重複失敗的警示。設定步驟
- 1記錄 job_started、job_completed、job_failed 和 job_retried。
- 2包括佇列、作業名稱、嘗試、持續時間、專案計數和錯誤型別。
- 3建置吞吐量、故障、重試和 p95 持續時間的儀表板。
- 4新增針對停滯作業、重複失敗和死信建立的警示。
要捕獲的事件
job_startedjob_completedjob_failedjob_retrieddead_letter_createdcron_tick_failed
由此解鎖的問題
- 哪些作業最常失敗或重試?
- 哪些佇列落後了?
- 哪些客戶會受到後台工作失敗的影響?
事件結構描述範例
此工作流程的事件結構描述
在將查詢或程式碼片段適應生產之前,請檢查行粒度、發出邊界、所需型別、隱私類、範例有效負載和驗證清單。
相關產品功能
繼續此工作流程 警示
將經過審查的可靠性查詢提升到擁有的閾值和回應工作流程中。
相關 SQL 查詢範例
更多 SQL 範例
針對此工作流程中的結構化欄位執行查詢,檢查範例結果,並將有用的答案轉換為儀表板或警示。
背景工作入門
測量後台作業重試和失敗率
哪些後台作業消耗的重試次數最多或仍然失敗?
開啟查詢範例背景工作中級
使用 SQL 查詢停滯的後台作業
哪些作業已啟動但從未產生終止事件?
開啟查詢範例背景工作入門
按作業測量佇列等待時間
哪些工作在工人開始之前等待的時間最長?
開啟查詢範例背景工作中級
測量死信佇列成長
哪些佇列新增死信作業的速度比解決死信作業的速度快?
開啟查詢範例背景工作中級
檢測錯過的 Cron 計劃
哪些預定作業的執行時間晚於記錄的時間間隔?
開啟查詢範例背景工作中級
檢測後台作業重試風暴
目前哪些工作型別在重試上花費的工作量最多?
開啟查詢範例查詢範例集背景工作 SQL
客戶案例
相關客戶案例
相關頁面