本文へ移動
Telemetry
コンテナ、ホスト、プロセス、ディスク、ネットワークメトリクスを追跡するチーム向け

SQL によるインフラストラクチャ メトリック

大規模な監視ロールアウトを行わずに、クエリ可能なホストとコンテナーの履歴が必要な場合に、構造化されたインフラストラクチャ イベントを送信します。

レビュー者 Telemetry 製品チーム . イベント項目、推奨クエリ、除外するデータを確認しました. このページのレビュー担当

なぜこれが機能するのか
  • SQL を使用して、コンテナー、ディスク、プロセス、システム、ネットワークのメトリックを分析します。
  • 必要に応じて、運用メトリクスを製品または顧客のイベントに結合します。
  • 小さな計測面から始めて、実際のしきい値の周囲にアラートを追加します。
ユースケースの証拠パス

Infrastructure metrics with SQL: 実装から決定まで

完全な infrastructure metrics with sql 測定ループは、1 つの所有ワークフロー、制限されたイベント コントラクト、制御されたフィクスチャ、および誰かが行動できる質問を接続します。

  1. 1

    境界を設定する

    ホスト、コンテナー、プロセス、および環境ラベルを使用してメトリック スナップショットをログに記録します。

  2. 2

    結果を把握する

    Begin with container_metric_recorded, disk_metric_recorded, system_metric_recorded and document the grain of each event.

  3. 3

    行を証明する

    しきい値の違反、傾向の変化、ハートビートの欠落を警告します。

  4. 4

    決断を下す

    どのコンテナまたはホストに継続的な圧力がかかっていますか?

エージェントプロンプト

これをコーディングエージェントに貼り付けます

交換する YOUR_API_KEY サインアップ後、エージェントに製品フローを実行して最初のイベントを確認するように依頼します。

エージェントプロンプト

Infrastructure metrics with SQL セットアップ プロンプト

text
Telemetry を使用してインフラストラクチャ メトリクスを計測します。

/skill.md とこの Telemetry API キーを使用します: YOUR_API_KEY

コンテナ、ディスク、システム、ネットワーク、プロセス、ハートビートのメトリクスをログに記録してください。 host_name、container_name、環境、metric_name、metric_value、単位、しきい値、status、および observed_at を含めます。

CPU、メモリ、ディスク、ネットワーク、プロセスの健全性、欠落しているハートビートに関するダッシュボードを作成します。継続的なしきい値違反とデータ欠落に対するアラートを追加します。

シークレット、環境変数値、認証情報を含むコマンド引数、または生のプロセス ペイロードをログに記録しないでください。

セットアップ手順

  1. 1ホスト、コンテナー、プロセス、および環境ラベルを使用してメトリック スナップショットをログに記録します。
  2. 2メトリック名を安定した状態に保ち、カーディナリティの高い識別子をフィールドに配置します。
  3. 3CPU、メモリ、ディスク、ネットワーク、プロセスの健全性に関するダッシュボードを作成します。
  4. 4しきい値の違反、傾向の変化、ハートビートの欠落を警告します。

キャプチャするイベント

container_metric_recordeddisk_metric_recordedsystem_metric_recordednetwork_metric_recordedprocess_metric_recordedheartbeat_missing

これにより解き明かされる質問

  • どのコンテナまたはホストに継続的な圧力がかかっていますか?
  • どのプロセスが製品インシデントと関連していますか?
  • ハートビートの報告が止まったホストや、ディスクの空き容量が少ないホストはどれですか?

イベントスキーマの例

クエリまたはスニペットを運用環境に適用する前に、行粒度、出力境界、必要なタイプ、プライバシー クラス、サンプル ペイロード、および検証チェックリストを確認してください。

関連製品の機能

このワークフローを続行します アラート

レビューされた信頼性クエリを、所有するしきい値と応答のワークフローにプロモートします。

関連する SQL レシピ

その他のSQL例

このワークフローの構造化フィールドに対してクエリを実行し、結果の例を検査して、有用な回答をダッシュボードまたはアラートに変換します。

すべてのレシピを参照する
インフラストラクチャー中級者

キャッシュミスとスタンピードのリスクを見つける

どのキャッシュ キー パターンが低いヒット率とバックエンドの同時作業を組み合わせていますか?

レシピを開く
インフラストラクチャー上級者向け

インシデントの検出と復旧時間を計算する

各サービスがインシデントを検出して回復するまでにどれくらいの時間がかかりますか?

レシピを開く
インフラストラクチャー初心者

ホストとコンテナのリソースの飽和状態を確認する

どのインフラストラクチャ ソースが永続的にリソース制限を受けていますか?

レシピを開く
構造化イベント初心者

欠落しているサービスのハートビートを検出する

ハートビートの送信を停止したと予想されるテレメトリ ソースはどれですか?

レシピを開く
API の信頼性中級者

p50、p95、p99 API レイテンシの計算

テール レイテンシが最も悪いエンドポイントはどれですか?

レシピを開く
API の信頼性初心者

ルート別のAPIエラー率の計算

リクエストが 20 件以上ある API ルートのうち、5xx エラー率が最も高いのはどれですか?

レシピを開く
インフラストラクチャー初心者

ワークロードごとに Kubernetes 再起動を検索する

どの Kubernetes ワークロードが再起動され、準備チェックに失敗していますか?

レシピを開く
データ品質初心者

イベント名によるTelemetryボリュームの測定

どのイベント コントラクトが最も多くの取り込み量を生み出しますか?

レシピを開く

次のステップ

エージェントが使用する API キーを作成します

プロンプトの実行、テスト イベントの送信、最初のダッシュボードの確認には無料プランで十分です。

関連ページ