Google Cloud Run Telemetry: 경계에서 검증된 행까지
제어된 애플리케이션 경계에서 Google Cloud Run Telemetry를 사용하고, 이벤트 계약을 작게 유지하고, 집계 뷰를 구축하기 전에 알려진 결과를 확인하세요.
- 1
결과를 선택하세요
서버리스 요청 안정성
- 2
계약 정의
서비스, 개정, 지역, route_template, job_name 및 릴리스
- 3
경계 계측
요청 또는 작업에 최종 결과가 발생한 후에 내보내고 공급자 기본 진단을 위해 플랫폼 요청 로그를 유지합니다.
- 4
증거를 확인하세요
Exercise a known fixture, then inspect cloud_run_request_completed for one correctly typed terminal row.
시작하기 전에
전제 조건 및 경계
- 신뢰할 수 있는 서버 코드에서 초기화된 telemetry-sh를 사용하는 Cloud Run 서비스 또는 작업
- 안정적인 서비스, 개정, 지역, 경로 및 작업 이름
- 요청 종료를 연장하거나 성공적인 워크로드에 실패할 수 없는 제한된 전달 동작
배송 설정
서버 측 설치 및 초기화
서버 전용 코드에서 telemetry-sh를 가져오고 process.env.TELEMETRY_API_KEY로 한 번 초기화합니다. 브라우저 번들, 클라이언트에 표시되는 환경 변수, 소스 제어, 로그 및 예외 메시지에서 수집 자격 증명을 유지하세요.
npm 설치
npm install telemetry-sh- 1제한된 네트워크 동작을 갖춘 재사용 가능한 서버 측 전달 클라이언트 하나를 준비합니다.
- 2성공, 실패, 재시도 또는 시간 초과 경계에 결과 이벤트를 추가합니다.
- 3알림을 활성화하기 전에 제어된 고정 장치를 보내고 저장된 행을 검사하십시오.
스니펫
하나의 체계적인 이벤트로 시작하세요
워크플로가 완료, 실패 또는 재시도되는 위치에 이 셰이프를 추가합니다. 그런 다음 실제 필드에서 대시보드를 구축합니다.
Google Cloud Run Telemetry 이벤트
await telemetry.log("cloud_run_request_completed", {
service: process.env.K_SERVICE,
revision: process.env.K_REVISION,
region: process.env.GOOGLE_CLOUD_REGION,
route_template: "/api/reports/:reportId",
status: responseStatus < 500 ? "success" : "failed",
status_code: responseStatus,
duration_ms: Math.round(performance.now() - startedAt),
request_id: requestId,
cold_start_observed: coldStartObserved,
environment: process.env.APP_ENV,
release: process.env.APP_RELEASE,
});이벤트 계약
서비스, 개정, 지역, route_template, job_name 및 릴리스
상태, status_code, duration_ms, 시도, instance_id_category 및 error_type
request_id, account_id, cold_start_observed, item_count 및 환경
구현 체크포인트
체크포인트 1
요청 또는 작업에 최종 결과가 발생한 후에 내보내고 공급자 기본 진단을 위해 플랫폼 요청 로그를 유지합니다.
체크포인트 2
가능한 경우 K_REVISION, K_SERVICE 및 K_CONFIGURATION를 사용하세요. 임시 인스턴스 식별자를 그룹화 차원에서 제외하세요.
체크포인트 3
짧은 전송 제한 시간을 설정하고 인스턴스 종료 동작을 확인하여 원격 분석으로 인해 응답이 지연되거나 작업 성공이 변경되지 않도록 합니다.
검증
이벤트가 도착했음을 증명하세요.
알려진 성공 및 실패 사례를 연습한 후 이를 실행하십시오. 최종 이벤트 계약이 스니펫과 다른 경우 대체 테이블 이름을 바꾸세요.
Google Cloud Run Telemetry 확인 쿼리
SELECT *
FROM cloud_run_request_completed
ORDER BY timestamp_utc DESC
LIMIT 20;구현 참조
새로운 프로덕션 경로를 활성화하기 전에 이벤트 계약, 데이터 안전 지침, 업스트림 기본 문서를 검토하세요.
프로덕션 경계
결과 이벤트를 작고 복구 가능하게 유지
이 패턴은 다음을 제공합니다.
- 업스트림 워크플로우 옆에 제한된 SQL 지원 결과가 있습니다.
- 대시보드, 알림 및 교차 이벤트 상관 관계를 위한 안정적인 필드입니다.
- 성공, 실패, 재시도 및 시간 초과 동작을 검증하기 위한 고정 장치 기반 경로입니다.
이 패턴은 제공하지 않습니다
- OTLP 내보내기, 자동 수집 파이프라인 또는 자세한 추적 및 진단 로그를 대체합니다.
- 페이로드에 이벤트 ID가 포함되어 있기 때문에 정확히 한 번만 전달됩니다.
- 원시 공급자 페이로드, 사용자 콘텐츠, 자격 증명 또는 규제 데이터를 수집할 수 있는 권한입니다.
이벤트 스키마 시작점
이 워크플로우에 대한 이벤트 계약
쿼리 또는 스니펫을 프로덕션에 적용하기 전에 행 그레인, 방출 경계, 필수 유형, 개인 정보 보호 클래스, 예제 페이로드 및 유효성 검사 체크리스트를 검토하세요.
관련 제품 기능
이 워크플로를 다음에서 계속하세요. 알림
검토된 신뢰성 쿼리를 소유한 임계값 및 응답 워크플로로 승격합니다.
관련 SQL 레시피
SQL로 다음 질문에 답하세요
이 워크플로의 구조화된 필드에 대해 쿼리를 실행하고, 예제 결과를 검사하고, 유용한 답변을 대시보드 또는 알림으로 전환하세요.
릴리스별 API 신뢰성 비교
어떤 릴리스가 더 나쁜 API 오류 또는 꼬리 지연 시간과 일치합니까?
레시피 열기경로별 API 오류율 계산
의미 있는 5xx 오류율이 가장 높은 API 경로는 무엇입니까?
레시피 열기p50, p95 및 p99 API 대기 시간 계산
꼬리 지연 시간이 가장 긴 엔드포인트는 무엇입니까?
레시피 열기백그라운드 작업 재시도 및 실패율 측정
가장 많은 재시도를 소비하거나 여전히 실패하는 백그라운드 작업은 무엇입니까?
레시피 열기누락된 서비스 하트비트 감지
어떤 예상 원격 분석 소스가 하트비트 전송을 중단했나요?
레시피 열기구현 제품군별로 찾아보기
관련 통합 패턴 비교
이 통합과 페어링할 템플릿
더 많은 통합
AWS ECS 및 Fargate Telemetry 통합
로컬 작업 메타데이터 엔드포인트를 사용하여 애플리케이션 결과에 ECS 작업 계열, 개정, 가용성 영역 및 릴리스 컨텍스트를 추가합니다.
가이드 열기애저 함수 Telemetry
호출, 재시도, 대기 시간, 릴리스 및 고객 영향 컨텍스트를 통해 Azure Functions HTTP, 타이머, 큐 및 이벤트 트리거 결과를 추적합니다.
가이드 열기Go HTTP 서버 구조적 로깅
경로 오류율, 대기 시간 백분위수 및 릴리스 비교를 위해 Go HTTP 서비스에 입력된 요청 결과 이벤트를 추가합니다.
가이드 열기