Infrastructure metrics with SQL: 実装から決定まで
完全な infrastructure metrics with sql 測定ループは、1 つの所有ワークフロー、制限されたイベント コントラクト、制御されたフィクスチャ、および誰かが行動できる質問を接続します。
- 1
境界を設定する
ホスト、コンテナー、プロセス、および環境ラベルを使用してメトリック スナップショットをログに記録します。
- 2
結果を把握する
Begin with container_metric_recorded, disk_metric_recorded, system_metric_recorded and document the grain of each event.
- 3
行を証明する
しきい値の違反、傾向の変化、ハートビートの欠落を警告します。
- 4
決断を下す
どのコンテナまたはホストに継続的な圧力がかかっていますか?
エージェントプロンプト
これをコーディングエージェントに貼り付けます
交換する YOUR_API_KEY サインアップ後、エージェントに製品フローを実行して最初のイベントを確認するように依頼します。
Infrastructure metrics with SQL セットアップ プロンプト
Telemetry を使用してインフラストラクチャ メトリクスを計測します。
/skill.md とこの Telemetry API キーを使用します: YOUR_API_KEY
コンテナ、ディスク、システム、ネットワーク、プロセス、ハートビートのメトリクスをログに記録してください。 host_name、container_name、環境、metric_name、metric_value、単位、しきい値、status、および observed_at を含めます。
CPU、メモリ、ディスク、ネットワーク、プロセスの健全性、欠落しているハートビートに関するダッシュボードを作成します。継続的なしきい値違反とデータ欠落に対するアラートを追加します。
シークレット、環境変数値、認証情報を含むコマンド引数、または生のプロセス ペイロードをログに記録しないでください。セットアップ手順
- 1ホスト、コンテナー、プロセス、および環境ラベルを使用してメトリック スナップショットをログに記録します。
- 2メトリック名を安定した状態に保ち、カーディナリティの高い識別子をフィールドに配置します。
- 3CPU、メモリ、ディスク、ネットワーク、プロセスの健全性に関するダッシュボードを作成します。
- 4しきい値の違反、傾向の変化、ハートビートの欠落を警告します。
キャプチャするイベント
これにより解き明かされる質問
- どのコンテナまたはホストに継続的な圧力がかかっていますか?
- どのプロセスが製品インシデントと関連していますか?
- ハートビートの報告が止まったホストや、ディスクの空き容量が少ないホストはどれですか?
イベントスキーマの例
このワークフローのイベントスキーマ
クエリまたはスニペットを運用環境に適用する前に、行粒度、出力境界、必要なタイプ、プライバシー クラス、サンプル ペイロード、および検証チェックリストを確認してください。
関連製品の機能
このワークフローを続行します アラート
レビューされた信頼性クエリを、所有するしきい値と応答のワークフローにプロモートします。
関連する SQL レシピ
その他のSQL例
このワークフローの構造化フィールドに対してクエリを実行し、結果の例を検査して、有用な回答をダッシュボードまたはアラートに変換します。
キャッシュミスとスタンピードのリスクを見つける
どのキャッシュ キー パターンが低いヒット率とバックエンドの同時作業を組み合わせていますか?
レシピを開くインシデントの検出と復旧時間を計算する
各サービスがインシデントを検出して回復するまでにどれくらいの時間がかかりますか?
レシピを開くホストとコンテナのリソースの飽和状態を確認する
どのインフラストラクチャ ソースが永続的にリソース制限を受けていますか?
レシピを開く欠落しているサービスのハートビートを検出する
ハートビートの送信を停止したと予想されるテレメトリ ソースはどれですか?
レシピを開くp50、p95、p99 API レイテンシの計算
テール レイテンシが最も悪いエンドポイントはどれですか?
レシピを開くルート別のAPIエラー率の計算
リクエストが 20 件以上ある API ルートのうち、5xx エラー率が最も高いのはどれですか?
レシピを開くワークロードごとに Kubernetes 再起動を検索する
どの Kubernetes ワークロードが再起動され、準備チェックに失敗していますか?
レシピを開くイベント名によるTelemetryボリュームの測定
どのイベント コントラクトが最も多くの取り込み量を生み出しますか?
レシピを開く次のステップ
エージェントが使用する API キーを作成します
プロンプトの実行、テスト イベントの送信、最初のダッシュボードの確認には無料プランで十分です。
関連ページ
Kubernetes SQL による信頼性モニタリング
Kubernetes のワークロードの移行とアプリケーションの結果をまとめて追跡することで、SQL は計画されたロールアウト アクティビティを繰り返しの再起動やサービスへの影響から分離できます。
ページを開くAPI 信頼性監視
API リクエストの量、ステータス コード、レイテンシー、タイムアウト、顧客への影響、障害が発生したエンドポイントを SQL で追跡します。
ページを開くClaude Code 可観測性
Claude Code に、テレメトリを別個のクリーンアップ プロジェクトではなく実装パスの一部にするプロンプトを表示します。
ページを開く