跳至主要內容
Telemetry
整合指南

Sidekiq 作業 Telemetry

追蹤 Sidekiq 執行結果、嘗試、佇列等待、錯誤以及伺服器中介軟體的釋放,而無需復製作業參數。

審閱者 Telemetry產品團隊 . 埋點合約、隱私邊界和實施指南. 審查標準和所有權

有用於
  • Sidekiq 重試監控
  • 佇列延遲分析
  • 後台作業可靠性
實施證據

Sidekiq Job Telemetry:從邊界到驗證行

在受控應用程式邊界使用 Sidekiq Job Telemetry,保持事件契約較小,並在建置聚合檢視之前驗證已知結果。

  1. 1

    選擇結果

    Sidekiq 重試監控

  2. 2

    定義合約

    job_id、job_name、queue_name、狀態和嘗試

  3. 3

    埋點邊界

    將收益包裝在伺服器中介軟體中,以便每次執行嘗試都有一個結果;使用 jid 作為邏輯識別符號,並使用 retry_count 加一作為嘗試。

  4. 4

    核實證據

    Exercise a known fixture, then inspect job_attempt_completed for one correctly typed terminal row.

開始之前

先決條件和界限

  • 具有顯式開啟和讀取超時的可重用 Ruby HTTP 包裝器
  • Sidekiq 伺服器中介軟體在每個工作處理程序中註冊
  • 穩定的作業類和佇列名稱以及批准的錯誤分類法

交貨設定

安裝並初始化伺服器端

使用帶有伺服器端金鑰以及顯式開啟和讀取超時的小型 Net::HTTP 包裝器。 將攝取憑據保留在瀏覽器包、客戶端可見的環境變數、原始碼控制、日誌和異常訊息之外。

  1. 1準備一個具有有限網路行為的可重用伺服器端交付客戶端。
  2. 2在成功、失敗、重試或超時邊界處新增結果事件。
  3. 3在啟用警示之前傳送受控裝置並檢查儲存的行。

片段

從一個結構化事件開始

在工作流程完成、失敗或重試的位置新增此形狀。然後從真實的欄位建置儀表板。

sidekiq

Sidekiq Job Telemetry事件

ruby
class TelemetryOutcomeMiddleware
  include Sidekiq::ServerMiddleware

  def call(_job_instance, job, queue)
    started_at = Process.clock_gettime(Process::CLOCK_MONOTONIC)
    status = "success"
    error_type = nil

    begin
      yield
    rescue => error
      status = "failed"
      error_type = classify_error(error)
      raise
    ensure
      TelemetryHttp.log(
        table: "job_attempt_completed",
        data: {
          job_id: job["jid"],
          job_name: job["class"],
          queue_name: queue,
          attempt: job.fetch("retry_count", -1) + 2,
          status: status,
          duration_ms: ((Process.clock_gettime(Process::CLOCK_MONOTONIC) - started_at) * 1000).round,
          error_type: error_type,
          release: ENV["APP_RELEASE"]
        }
      )
    end
  end
end

活動合約

job_id、job_name、queue_name、狀態和嘗試

queue_wait_ms、duration_ms、error_type、retry_exhausted 和釋放

item_count 或由作業派生的批准帳戶上下文,從不序列化參數

實施檢查點

檢查站 1

將收益包裝在伺服器中介軟體中,以便每次執行嘗試都有一個結果;使用 jid 作為邏輯識別符號,並使用 retry_count 加一作為嘗試。

檢查站 2

不要在沒有重新加註的情況下救援,因為 Sidekiq 必須遵守異常才能應用其重試政策。

檢查站 3

如果每次嘗試都會發出事件,請明確建置終端成功和重試耗盡指標,以便重試不會增加作業總數。

驗證

證明事件已到達

在演練已知的成功和失敗案例後執行此命令。如果您的最終事件契約與程式碼片段不同,請替換後備資料表名稱。

sidekiq-verification

Sidekiq Job Telemetry 驗證查詢

sql
SELECT *
FROM job_attempt_completed
ORDER BY timestamp_utc DESC
LIMIT 20;
確認每個邏輯結果的一個終端行,以及預期狀態、識別符號、單位和 UTC 時間。
檢查推斷的架構並驗證重試不會更改欄位型別或生成新的邏輯事件 ID。
在儲存的欄位中搜尋憑據、原始有效負載、提示、私有內容和無限制的錯誤訊息。
在將儀表板視為完整之前,請執行提供程式超時、攝取拒絕和處理程序關閉。

實施參考

在啟用新的生產路徑之前,請檢查事件合約、資料安全指南和上游主要文件。

生產邊界

保持結果事件小且可恢復

該模式提供了

  • 除了上游工作流程之外,還有一個有界的、SQL 就緒的結果。
  • 用於儀表板、警示和跨事件關聯的穩定欄位。
  • 用於驗證成功、失敗、重試和超時行為的夾具驅動路徑。

該模式不提供

  • OTLP 匯出器、自動收集管道或詳細追蹤和診斷日誌的替代品。
  • 僅因為有效負載包含事件 ID,所以僅傳送一次。
  • 收集原始提供商有效負載、使用者內容、憑證或受監管資料的權限。

事件架構起點

在將查詢或程式碼片段適應生產之前,請檢查行粒度、發出邊界、所需型別、隱私類、範例有效負載和驗證清單。

相關產品功能

繼續此工作流程 警示

將經過審查的可靠性查詢提升到擁有的閾值和回應工作流程中。

相關 SQL 查詢範例

用 SQL 回答下一個問題

針對此工作流程中的結構化欄位執行查詢,檢查範例結果,並將有用的答案轉換為儀表板或警示。

瀏覽所有查詢範例
完整系列背景工作 SQL

按實施系列瀏覽

比較相關整合模式

與此整合配對的範本

更多整合