Google PCA: 안정성, 재해 복구 및 비즈니스 연속성 — 학습 가이드

다음의 일부입니다: Google Professional Cloud Architect — 학습 가이드. 검증된 답안으로 연습하기: Google 시험 허브, 또는 다음에서 시간 제한 모의고사 풀기: ExamRoll.io.

개요

안정성, 재해 복구(DR), 비즈니스 연속성은 구성 요소, 영역 또는 리전 장애에도 불구하고 서비스가 합의된 목표를 계속 충족하도록 보장합니다. Google Cloud에서 안정성은 장애 도메인(영역, 리전, 글로벌)을 이해하고, 복구 목표(RTO/RPO)를 정의하고, 복원력 있는 서비스 아키텍처(예: active-active)를 선택하고, 복구 계획을 엄격하게 테스트함으로써 설계됩니다. 설계 시 서비스 중요도를 명시적인 가용성 목표, 내구성 보장, 검증된 복구 경로에 매핑해야 하며, 가용성, 일관성, 비용, 운영 복잡성 간의 균형을 맞춰야 합니다. 주요 주제에는 단일 장애점(SPOF) 격리, 가능한 경우 관리형 복제 사용, 장애 조치 결정 자동화, 프로덕션과 유사한 환경에서 가정이 유효한지 지속적으로 검증하는 것이 포함됩니다.

장애 도메인, 위치, 다중 리전 서비스

장단점(Trade-offs):

목표, 종속성 매핑, DR 검증

복원력 있는 컴퓨팅, 데이터베이스, 스토리지 패턴

    gcloud compute firewall-rules create allow-lb-health-checks \
      --network=prod-vpc --action=ALLOW --direction=INGRESS \
      --rules=tcp:80,tcp:443 \
      --source-ranges=130.211.0.0/22,35.191.0.0/16 \
      --target-tags=web-backend
    ```

  - 로컬 상태를 피하고, 세션을 Memorystore나 데이터베이스로 외부화합니다. 스케일 인(scale-in) 중 진행 중인 요청을 보존하기 위해 백엔드에서 연결 드레이닝(connection draining)을 사용합니다.
  - 일반적인 장애 모드: 잘못된 상태 확인(너무 많거나 적은 항목을 확인), 누락된 방화벽 규칙, 비정상적인 다운스트림에 의존하는 부트스트래핑.
- Cloud SQL 복원력:
  - 고가용성(High availability): 별도의 영역에 기본(primary) 및 대기(standby) 인스턴스를 두고 동기식 디스크 복제 및 자동 장애 조치(failover)를 사용합니다. 유지보수 기간을 선택하고 장애 조치를 테스트합니다.
  - 읽기 복제본(Read replicas): 동일 리전 또는 교차 리전 읽기 복제본을 추가하여 읽기 부하를 분산하고 리전 이벤트에 대한 RTO를 줄입니다. DR 시 복제본을 승격시킵니다.
  - 백업 및 PITR(특정 시점 복구):
    - 규정 준수 및 RPO를 위해 충분한 보존 기간을 설정하여 바이너리/트랜잭션 로그를 통해 자동 일일 백업 및 특정 시점 복구(PITR)를 활성화합니다.
    - 비프로덕션 환경으로의 복원을 검증하고, 승격 절차 및 애플리케이션 연결 문자열 업데이트를 연습합니다.
  - 네트워크: 프로덕션 환경에서는 비공개 IP를 선호합니다. 장애 조치 테스트 시 DNS/연결 풀링 동작을 검증해야 합니다.
  - 운영 팁: 주기적으로 제어된 장애 조치를 실행하여 애플리케이션 풀이 깨끗하게 다시 연결되는지 확인합니다.
gcloud sql instances failover prod-sql
```
    {
      "rule": [
        {
          "action": { "type": "Delete" },
          "condition": { "age": 90, "isLive": false }
        }
      ]
    }
    ```

    적용 방법:
gsutil lifecycle set lifecycle.json gs://prod-backups
```

트래픽 관리, 다중 사이트 전략 및 지속적인 복원력

실제 문제 시나리오

빠르게 성장하는 온라인 티켓팅 회사인 Acme Tickets는 구매 API와 이벤트 카탈로그에 대해 리전 장애 발생 시에도 RTO ≤ 5분, RPO ≤ 1분이라는 엄격한 RTO/RPO를 유지하면서 지속적인 운영을 보장해야 합니다. 스택은 상태 비저장(stateless) 마이크로서비스, 관계형 주문 데이터베이스, 분석 파이프라인, 정적 미디어 자산으로 구성됩니다.

  1. 서비스 등급, SLO 및 복구 목표 정의
  1. 리전 배치 및 다중 사이트 전략 선택
  1. 리전 MIG 및 글로벌 HTTP(S) 부하 분산 구현
  1. 상태 외부화 및 자가 복구 구성
  1. HA 및 교차 리전 읽기 복제본을 갖춘 Cloud SQL for PostgreSQL 프로비저닝
  1. 정기적인 데이터베이스 장애 조치 테스트 예약
  1. 버전 관리 및 보존 기능이 있는 이중 리전 Cloud Storage 버킷에 정적 미디어 배치
  1. 방화벽 및 할당량으로 상태 확인 및 이그레스(egress) 보호
  1. 낮은 TTL을 사용하여 DNS를 대략적인 제어 수단으로 구현
  1. DR 런북 자동화 및 게임 데이를 통한 검증
  1. 백업 보안 및 분리
  1. 정상 성능 저하(Graceful Degradation) 구현

이 아키텍처는 상태 비저장 서비스를 위한 자동화된 리전 장애 조치, 상태 저장 구성 요소를 위한 통제되고 테스트된 장애 조치, 그리고 Acme Tickets의 비즈니스 연속성 목표를 충족하는 검증된 복구 프로세스를 제공합니다.


보안 · 모든 도메인 · 마이그레이션

이 문제 연습하기 → · ExamRoll.io에서 시간 제한 연습 →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

시험 합격하기 →

Google 찾아보기 →

Related guides

올인원 액세스

하나의 구독. 모든 시험.

모든 플랜은 무제한 답변 검색, 모의고사, AI 해설, 전체 자료 라이브러리를 20개 이상의 언어로 잠금 해제합니다.

월간
24.87
Just €0.83/day
모든 포함:
  • 무제한 답변 검색
  • 무제한 모의고사
  • AI 기반 해설
  • 전체 자료 라이브러리
  • 20개 이상의 언어
  • 주간 콘텐츠 업데이트
  • 보상 및 추천
  • 우선 지원
무료 체험 시작

신용카드 필요 없음*

최고의 가치
12개월
179.87
Just €0.49/daySave 40%
모든 포함:
  • 무제한 답변 검색
  • 무제한 모의고사
  • AI 기반 해설
  • 전체 자료 라이브러리
  • 20개 이상의 언어
  • 주간 콘텐츠 업데이트
  • 보상 및 추천
  • 우선 지원
무료 체험 시작

신용카드 필요 없음*

✓ 무료 플랜 포함 · ✓ 언제든지 취소 가능 · ✓ 모든 플랜은 전체 제품을 잠금 해제합니다