イベント契約
クエリが期待するフィールド
| フィールド | 種類 | なぜ存在するのか |
|---|---|---|
| timestamp_utc | Timestamp | UTC でのサンプル時間または遷移時間。 |
| cluster | Utf8 | 制御対象のクラスター名。 |
| namespace | Utf8 | Kubernetes 名前空間。 |
| workload | Utf8 | デプロイメント、StatefulSet、またはジョブの所有者名。 |
| pod | Utf8 | 制限付きドリルダウンのポッド識別子。 |
| event_name | Utf8 | 制御されたサンプリング イベントまたは container_restarted イベント。 |
| restart_count | Int64 | 観測されたコンテナーの累積再起動数。 |
| ready | Boolean | ポッドがサンプル時に準備ができているかどうか。 |
| environment | Utf8 | 導入環境。 |
クエリをコピーする
SELECT
cluster,
namespace,
workload,
COUNT(*) AS observations,
SUM(CASE WHEN event_name = 'container_restarted' THEN 1 ELSE 0 END) AS restart_events,
MAX(restart_count) AS max_restart_count,
SUM(CASE WHEN ready THEN 0 ELSE 1 END) AS not_ready_observations,
100.0 * SUM(CASE WHEN ready THEN 0 ELSE 1 END)
/ NULLIF(COUNT(*), 0) AS not_ready_rate_pct
FROM kubernetes_workload_events
WHERE timestamp_utc >= now() - INTERVAL '24 hours'
AND environment = 'production'
GROUP BY cluster, namespace, workload
ORDER BY restart_events DESC, not_ready_rate_pct DESC, workload;この読み取り専用クエリは、空の型付きテーブルに対して計画され、実行されます。 アパッチ DataFusion 45.2.0。決定論的なサンプル出力は合成され、個別にレビューされます。フィールド タイプ、しきい値、ビジネス定義を独自のデータと照合して検証します。 テスト方法を読んでください。
クエリ結果
ワークロードごとの再起動と準備完了のシグナル
チェックアウトには、請求ワーカーよりも多くの再起動遷移と準備ができていない観察が含まれます。
| cluster | namespace | workload | observations | restart_events | max_restart_count | not_ready_observations | not_ready_rate_pct |
|---|---|---|---|---|---|---|---|
| production-us | application | checkout-api | 5 | 2 | 4 | 2 | 40 |
| production-us | application | billing-worker | 4 | 1 | 2 | 1 | 25 |
合成出力例。運用上の決定に使用する前に、独自のイベント スキーマとしきい値に対してクエリを実行します。
例を再現する
パブリックフィクスチャをダウンロードする
JSON バンドルには、型付きイベント コントラクトが含まれています。 reproducible 入力行、正確な SQL、予想される出力、レビューメモ、およびエンジンのバージョン。 CSV には、表示された結果が含まれます。
SQL の仕組み
- 1ワークロードの所有権はポッド名よりも安定しており、結果をデプロイ可能なユニットにマップします。
- 2ゲージの合計を避けるために、再起動遷移は累積カウンターとは別にカウントされます。
- 3準備状況の観察により、潜在的なサービス提供への影響と並行して運用上の症状が抑えられます。
決定すべきエッジケース
- ロールアウトは当然ポッドを置き換えます。計画された交換と、繰り返されるコンテナの再起動を区別します。
- ポッドが再作成されるとカウンターがリセットされる可能性があるため、レートには遷移イベントを使用します。
- 再起動がコード変更によるものであると考える前に、デプロイメントとアプリケーションのリリースのコンテキストを結合してください。
推奨されるダッシュボード
- 積み上げバー: ワークロード別の restart_events および not_ready_observations
- 傾向: クラスターと名前空間ごとに移行を再開する
- 表: 影響を受ける最新のポッドとリリースおよび制御された理由
レシピを活用する
関連する機器とガイド
ソースデータを定義する
この分析のイベント スキーマ
分析を続ける
実際のイベントで実行する
テーブルを作成し、フィールドを調整して、結果を保存します
無料で始めて、構造化されたイベントを送信し、クエリ結果をグラフ、共有ダッシュボード ウィジェット、またはアラート入力として使用します。