跳至主要內容
Telemetry
適用於執行佇列、cron 作業、匯入和非同步工作人員的團隊

後台作業監控

使用結構化事件檢視作業吞吐量、重試、失敗、死信、佇列執行狀況和 p95 持續時間。

審閱者 Telemetry產品團隊 . 我們檢查了事件欄位、建議查詢和要排除的資料. 誰負責審查此頁面

為什麼這有效
  • 按作業名稱、佇列、工作人員和客戶帳戶查詢重複的失敗。
  • 在停滯的作業成為客戶問題之前捕獲並重試迴圈。
  • 提供支援並設計一份可查詢的非同步工作歷史記錄。
用例證據路徑

Background job monitoring:從實施到決策

完整的 background job monitoring 測量迴圈連線一個擁有的工作流程、一個有界事件契約、一個受控裝置和一個有人可以採取行動的問題。

  1. 1

    設定邊界

    記錄 job_started、job_completed、job_failed 和 job_retried。

  2. 2

    捕捉結果

    Begin with job_started, job_completed, job_failed and document the grain of each event.

  3. 3

    證明行數

    新增針對停滯作業、重複失敗和死信建立的警示。

  4. 4

    做出決定

    哪些作業最常失敗或重試?

用例與範本

選擇要衡量的內容

使用用例指南來選擇結果、事件邊界和分析問題。當您準備好接受較短的複製貼上實施簡介時,請開啟匹配的範本。

開啟 後台作業失敗監視器

代理提示

將其貼上到您的編碼代理中

更換 YOUR_API_KEY 註冊後,然後要求代理執行產品流程並驗證第一個事件。

代理提示

Background job monitoring 設定提示

text
使用 Telemetry 檢測後台作業和非同步工作人員。

使用 /skill.md 和此 Telemetry API 金鑰:YOUR_API_KEY

請使用 job_name、queue_name、attempt、status、duration_ms、scheduled_at、started_at、completed_at、item_count 記錄 job_started、job_completed 和 job_failed 事件, retry_count 和 error_type。

建立一個儀表板,顯示按作業列出的吞吐量、按作業列出的故障、p95 持續時間、重試量、最舊的掛起作業和死信事件。新增針對停滯作業和重複失敗的警示。

設定步驟

  1. 1記錄 job_started、job_completed、job_failed 和 job_retried。
  2. 2包括佇列、作業名稱、嘗試、持續時間、專案計數和錯誤型別。
  3. 3建置吞吐量、故障、重試和 p95 持續時間的儀表板。
  4. 4新增針對停滯作業、重複失敗和死信建立的警示。

要捕獲的事件

job_startedjob_completedjob_failedjob_retrieddead_letter_createdcron_tick_failed

由此解鎖的問題

  • 哪些作業最常失敗或重試?
  • 哪些佇列落後了?
  • 哪些客戶會受到後台工作失敗的影響?

事件結構描述範例

在將查詢或程式碼片段適應生產之前,請檢查行粒度、發出邊界、所需型別、隱私類、範例有效負載和驗證清單。

相關產品功能

繼續此工作流程 警示

將經過審查的可靠性查詢提升到擁有的閾值和回應工作流程中。

相關 SQL 查詢範例

更多 SQL 範例

針對此工作流程中的結構化欄位執行查詢,檢查範例結果,並將有用的答案轉換為儀表板或警示。

瀏覽所有查詢範例
查詢範例集背景工作 SQL

客戶案例

相關客戶案例

下一步

建立您的代理將使用的 API 金鑰

免費計劃足以執行提示、傳送測試事件和檢視第一個儀表板。

相關頁面