Google PCA: Zuverlässigkeit, Disaster Recovery und Geschäftskontinuität — Lernleitfaden

Teil des Google Professional Cloud Architect — Lernleitfaden. Üben Sie mit verifizierten Antworten im Google-Prüfungscenter, oder absolvieren Sie zeitlich begrenzte Übungstests auf ExamRoll.io.

Überblick

Ausfallsicherheit, Notfallwiederherstellung (Disaster Recovery, DR) und Geschäftskontinuität stellen sicher, dass Dienste trotz Ausfällen von Komponenten, Zonen oder Regionen die vereinbarten Ziele weiterhin erfüllen. In Google Cloud wird Ausfallsicherheit durch das Verständnis von Ausfalldomänen (zonal, regional und global), die Definition von Wiederherstellungszielen (RTO/RPO), die Auswahl robuster Dienstarchitekturen (z. B. Aktiv-Aktiv) und das rigorose Testen von Wiederherstellungsplänen erreicht. Ihr Design muss die Kritikalität von Diensten auf explizite Verfügbarkeitsziele, Dauerhaftigkeitsgarantien und validierte Wiederherstellungspfade abbilden und dabei Verfügbarkeit, Konsistenz, Kosten und betriebliche Komplexität abwägen. Wichtige Themen sind die Isolierung von Single Points of Failure, die Nutzung von verwalteter Replikation, wo immer möglich, die Automatisierung von Failover-Entscheidungen und die kontinuierliche Überprüfung, ob Annahmen unter produktionsähnlichen Bedingungen zutreffen.

Ausfalldomänen, Standorte und multiregionale Dienste

Abwägungen:

Ziele, Abhängigkeits-Mapping und DR-Validierung

Resiliente Muster für Compute, Datenbanken und Storage

    gcloud compute firewall-rules create allow-lb-health-checks \
      --network=prod-vpc --action=ALLOW --direction=INGRESS \
      --rules=tcp:80,tcp:443 \
      --source-ranges=130.211.0.0/22,35.191.0.0/16 \
      --target-tags=web-backend
    ```

  - Vermeiden Sie lokalen Zustand; lagern Sie Sitzungen in Memorystore oder Datenbanken aus; verwenden Sie Connection Draining bei Backends, um laufende Anfragen während des Scale-in zu erhalten.
  - Häufige Fehlermodi: falsch ausgerichtete Health Checks (die zu viel oder zu wenig prüfen), fehlende Firewall-Regeln und Bootstrapping, das von fehlerhaften Downstream-Systemen abhängt.
- Resilienz von Cloud SQL:
  - Hochverfügbarkeit: Primär- und Standby-Instanz in separaten Zonen mit synchroner Festplattenreplikation und automatischem Failover; wählen Sie ein Wartungsfenster und testen Sie Failover.
  - Lesereplikas: Fügen Sie Lesereplikas in derselben Region oder regionsübergreifend hinzu, um Lesezugriffe auszulagern und die RTO bei regionalen Ereignissen zu reduzieren; stufen Sie Replikas während des DR hoch.
  - Backups und PITR:
    - Aktivieren Sie automatisierte tägliche Backups und Point-in-Time-Recovery (PITR) über Binär-/Transaktionsprotokolle mit ausreichender Aufbewahrungsdauer für Compliance und RPO.
    - Validieren Sie Wiederherstellungen in Nicht-Produktionsumgebungen und üben Sie die Hochstufungsverfahren sowie die Aktualisierung der Anwendungs-Connection-Strings.
  - Netzwerk: Bevorzugen Sie private IP für die Produktion; stellen Sie sicher, dass Failover-Tests das Verhalten von DNS/Connection-Pooling validieren.
  - Praxistipp: Führen Sie regelmäßig ein kontrolliertes Failover durch, um zu überprüfen, ob sich die Anwendungs-Pools sauber wieder verbinden.
gcloud sql instances failover prod-sql
```
    {
      "rule": [
        {
          "action": { "type": "Delete" },
          "condition": { "age": 90, "isLive": false }
        }
      ]
    }
    ```

    Anwenden mit:
gsutil lifecycle set lifecycle.json gs://prod-backups
```

Traffic-Management, Multi-Site-Strategien und kontinuierliche Resilienz

Praktisches Problemszenario

Acme Tickets, ein schnell wachsendes Online-Ticketing-Unternehmen, muss den kontinuierlichen Betrieb seiner Kauf-API und seines Veranstaltungskatalogs bei regionalen Ausfällen sicherstellen und dabei strenge RTO/RPO-Vorgaben einhalten (RTO ≤ 5 Minuten, RPO ≤ 1 Minute). Der Stack umfasst zustandslose Microservices, eine relationale Bestelldatenbank, eine Analyse-Pipeline und statische Medieninhalte.

  1. Service-Tiers, SLOs und Wiederherstellungsziele definieren
  1. Regionale Platzierung und Multi-Site-Strategie wählen
  1. Regionale MIGs und globales HTTP(S)-Load-Balancing implementieren
  1. Zustand externalisieren und Selbstheilung konfigurieren
  1. Cloud SQL for PostgreSQL mit HA und regionsübergreifender Lesereplika bereitstellen
  1. Routinemäßige Datenbank-Failover-Tests planen
  1. Statische Medien in einem Dual-Region Cloud Storage-Bucket mit Versionierung und Aufbewahrung platzieren
  1. Zustandsprüfungen und Egress-Traffic mit Firewall und Kontingenten schützen
  1. DNS als grobe Steuerung mit niedrigem TTL implementieren
  1. DR-Runbooks automatisieren und durch Game Days validieren
  1. Backups sichern und trennen
  1. Graceful Degradation implementieren

Diese Architektur bietet ein automatisiertes regionales Failover für zustandslose Dienste, ein kontrolliertes und getestetes Failover für zustandsbehaftete Komponenten und verifizierte Wiederherstellungsprozesse, die die Ziele der Geschäftskontinuität von Acme Tickets erfüllen.


Sicherheit · Alle Domänen · Migration

Diese Fragen üben → · Zeitlich begrenzte Übung auf ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Bestehe deine Prüfung →

Google durchsuchen →

Related guides

All-in-One Zugang

Ein Abonnement. Jede Prüfung.

Jeder Plan schaltet unbegrenzte Antwortsuche, Übungstests, KI-Erklärungen und die vollständige Ressourcenbibliothek frei – in über 20 Sprachen.

Monatlich
24.87
Just €0.83/day
Alles inklusive:
  • Unbegrenzte Antwortsuche
  • Unbegrenzte Übungstests
  • KI-gestützte Erklärungen
  • Vollständige Ressourcenbibliothek
  • Über 20 Sprachen
  • Wöchentliche Inhaltsaktualisierungen
  • Belohnungen & Empfehlungen
  • Priorisierter Support
Kostenlose Testphase starten

Keine Kreditkarte erforderlich*

Bestes Preis-Leistungs-Verhältnis
12 Monate
179.87
Just €0.49/daySave 40%
Alles inklusive:
  • Unbegrenzte Antwortsuche
  • Unbegrenzte Übungstests
  • KI-gestützte Erklärungen
  • Vollständige Ressourcenbibliothek
  • Über 20 Sprachen
  • Wöchentliche Inhaltsaktualisierungen
  • Belohnungen & Empfehlungen
  • Priorisierter Support
Kostenlose Testphase starten

Keine Kreditkarte erforderlich*

✓ Kostenloser Plan enthalten · ✓ Jederzeit kündbar · ✓ Alle Pläne schalten das vollständige Produkt frei