Google PCA: Niezawodność, odtwarzanie po awarii i ciągłość działania — Przewodnik do nauki

Część Google Professional Cloud Architect — Przewodnik do nauki. Ćwicz ze zweryfikowanymi odpowiedziami w centrum egzaminów Google, albo rozwiąż testy na czas na ExamRoll.io.

Przegląd

Niezawodność, odzyskiwanie po awarii (DR) i ciągłość działania zapewniają, że usługi nadal spełniają uzgodnione cele pomimo awarii komponentów, stref czy regionów. W Google Cloud niezawodność jest projektowana poprzez zrozumienie domen awarii (strefowych, regionalnych i globalnych), definiowanie celów odzyskiwania (RTO/RPO), wybór odpornych architektur usług (np. aktywny-aktywny) oraz rygorystyczne testowanie planów odzyskiwania. Twój projekt musi odwzorowywać krytyczność usług na jawne cele dostępności, gwarancje trwałości i zweryfikowane ścieżki odzyskiwania, równoważąc dostępność, spójność, koszty i złożoność operacyjną. Kluczowe zagadnienia obejmują izolowanie pojedynczych punktów awarii, wykorzystywanie zarządzanej replikacji tam, gdzie to możliwe, automatyzację decyzji o przełączaniu awaryjnym (failover) oraz ciągłą weryfikację, czy założenia sprawdzają się w warunkach zbliżonych do produkcyjnych.

Domeny awarii, lokalizacje i usługi wieloregionalne

Kompromisy:

Cele, mapowanie zależności i walidacja DR

Odporne wzorce dla zasobów obliczeniowych, baz danych i pamięci masowej

    gcloud compute firewall-rules create allow-lb-health-checks \
      --network=prod-vpc --action=ALLOW --direction=INGRESS \
      --rules=tcp:80,tcp:443 \
      --source-ranges=130.211.0.0/22,35.191.0.0/16 \
      --target-tags=web-backend
    ```

  - Unikaj stanu lokalnego; eksternalizuj sesje do Memorystore lub baz danych; używaj opróżniania połączeń (connection draining) na backendach, aby zachować przetwarzane żądania podczas skalowania w dół.
  - Typowe przyczyny awarii: niedopasowane kontrole stanu (sprawdzające zbyt wiele lub zbyt mało), brakujące reguły zapory sieciowej oraz bootstrapping zależny od niedziałających usług podrzędnych.
- Odporność Cloud SQL:
  - Wysoka dostępność: instancja podstawowa i zapasowa (standby) w oddzielnych strefach z synchroniczną replikacją dysku i automatycznym przełączaniem awaryjnym (failover); wybierz okno konserwacyjne i testuj przełączenia awaryjne.
  - Repliki do odczytu: dodaj repliki do odczytu w tym samym regionie lub w innym regionie, aby odciążyć operacje odczytu i zmniejszyć RTO w przypadku zdarzeń regionalnych; promuj repliki podczas odtwarzania po awarii (DR).
  - Kopie zapasowe i PITR:
    - Włącz automatyczne codzienne kopie zapasowe i odzyskiwanie do punktu w czasie (PITR) za pomocą logów binarnych/transakcyjnych z retencją wystarczającą do spełnienia wymogów zgodności i RPO.
    - Weryfikuj odtwarzanie kopii zapasowych w środowisku nieprodukcyjnym oraz przećwicz procedury promowania replik i aktualizacji parametrów połączenia (connection string) w aplikacji.
  - Sieć: preferuj prywatny adres IP dla środowiska produkcyjnego; upewnij się, że testy przełączania awaryjnego weryfikują zachowanie DNS i puli połączeń.
  - Wskazówka operacyjna: okresowo wykonuj kontrolowane przełączenie awaryjne, aby zweryfikować, czy pule połączeń aplikacji ponownie nawiązują połączenie bez błędów.
gcloud sql instances failover prod-sql
```
    {
      "rule": [
        {
          "action": { "type": "Delete" },
          "condition": { "age": 90, "isLive": false }
        }
      ]
    }
    ```

    Zastosuj za pomocą:
gsutil lifecycle set lifecycle.json gs://prod-backups
```

Zarządzanie ruchem, strategie wieloośrodkowe i ciągła odporność

Praktyczny scenariusz problemowy

Acme Tickets, szybko rozwijająca się firma zajmująca się sprzedażą biletów online, musi zapewnić ciągłość działania podczas awarii regionalnych dla swojego API zakupowego i katalogu wydarzeń, utrzymując jednocześnie rygorystyczne RTO/RPO (RTO ≤ 5 minut, RPO ≤ 1 minuta). Stos technologiczny obejmuje bezstanowe mikroserwisy, relacyjną bazę danych zamówień, potok analityczny oraz statyczne zasoby multimedialne.

  1. Zdefiniuj poziomy usług (service tiers), wskaźniki SLO i cele odzyskiwania (recovery objectives)
  1. Wybierz rozmieszczenie regionalne i strategię wieloośrodkową
  1. Zaimplementuj regionalne grupy MIG i globalny load balancing HTTP(S)
  1. Eksternalizuj stan i skonfiguruj samonaprawę (self-healing)
  1. Udostępnij Cloud SQL for PostgreSQL z wysoką dostępnością (HA) i repliką do odczytu w innym regionie
  1. Zaplanuj rutynowe testy przełączania awaryjnego bazy danych
  1. Umieść statyczne multimedia w zasobniku (bucket) Cloud Storage typu dual-region z włączonym wersjonowaniem i przechowywaniem
  1. Zabezpiecz kontrole kondycji i ruch wychodzący (egress) za pomocą zapory sieciowej i limitów (quotas)
  1. Zaimplementuj DNS jako zgrubny mechanizm kontroli z niskim TTL
  1. Zautomatyzuj scenariusze odzyskiwania po awarii (DR runbooks) i weryfikuj je podczas dni testowych (game days)
  1. Zabezpiecz i oddziel kopie zapasowe
  1. Zaimplementuj łagodną degradację

Ta architektura zapewnia zautomatyzowane regionalne przełączanie awaryjne dla usług bezstanowych, kontrolowane i przetestowane przełączanie awaryjne dla komponentów stanowych oraz zweryfikowane procesy odzyskiwania, które spełniają cele ciągłości biznesowej Acme Tickets.


Bezpieczeństwo · Wszystkie domeny · Migracja

Przećwicz te pytania → · Testy na czas na ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Zdaj egzamin →

Przeglądaj Google →

Related guides

Dostęp all-in-one

Jedna subskrypcja. Każdy egzamin.

Każdy plan odblokowuje nieograniczone wyszukiwanie odpowiedzi, testy praktyczne, wyjaśnienia AI i pełną bibliotekę zasobów — w ponad 20 językach.

Miesięczny
24.87
Just €0.83/day
Wszystko w cenie:
  • Nieograniczone wyszukiwanie odpowiedzi
  • Nieograniczone testy praktyczne
  • Wyjaśnienia wspomagane AI
  • Pełna biblioteka zasobów
  • Ponad 20 języków
  • Cotygodniowe aktualizacje treści
  • Nagrody i polecenia
  • Priorytetowe wsparcie
Rozpocznij bezpłatny okres próbny

Karta kredytowa nie jest wymagana*

Najlepsza wartość
12 miesięcy
179.87
Just €0.49/daySave 40%
Wszystko w cenie:
  • Nieograniczone wyszukiwanie odpowiedzi
  • Nieograniczone testy praktyczne
  • Wyjaśnienia wspomagane AI
  • Pełna biblioteka zasobów
  • Ponad 20 języków
  • Cotygodniowe aktualizacje treści
  • Nagrody i polecenia
  • Priorytetowe wsparcie
Rozpocznij bezpłatny okres próbny

Karta kredytowa nie jest wymagana*

✓ Plan darmowy w zestawie · ✓ Anuluj w dowolnym momencie · ✓ Wszystkie plany odblokowują pełny produkt