Google ACE: Zuverlässigkeit, Backup und Notfallwiederherstellung — Lernleitfaden

Teil des Google Associate Cloud Engineer — Lernleitfaden. Üben Sie mit verifizierten Antworten im Google-Prüfungscenter, oder absolvieren Sie zeitlich begrenzte Übungstests auf ExamRoll.io.

Überblick

Zuverlässigkeit, Backup und Disaster Recovery in Google Cloud erfordern ein bewusstes Design, das Fehlerdomänen, Datenschutzmechanismen, Traffic-Management und Betriebsbereitschaft berücksichtigt. Dieser Abschnitt erklärt, wie Dienste über Zonen und Regionen hinweg strukturiert werden, wie zustandsbehaftete Daten geschützt und wiederhergestellt werden und wie Wiederherstellungsziele durch disziplinierte Runbooks und kontinuierliche Resilienztests validiert werden. Er skizziert auch die Kompromisse bei DR-Strategien und die Kapazitätsplanung, um sicherzustellen, dass die Plattform innerhalb der definierten Wiederherstellungszeitziele (RTO) und Wiederherstellungspunktziele (RPO) wiederhergestellt werden kann.

Fehlerdomänen und regionales Design

Beispiel:

Resilienzbetrieb und kontinuierliche Verbesserung

Praktisches Problemszenario

Brightlane Retail betreibt eine E-Commerce-Plattform in us-central1 mit strengen Verfügbarkeitsanforderungen und einem RPO von vier Stunden für Bestelldaten. Die Geschäftsführung fordert, dass ein zonaler Ausfall ohne Ausfallzeit und ein regionaler Ausfall mit minimalen Auswirkungen auf die Kunden überstanden wird.

Vorgehensweise:

  1. Implementieren Sie eine regionale MIG mit HTTP-Autohealing und einem globalen HTTP(S) Load Balancer
    • Begründung: Eine regionale MIG verteilt Instanzen über mehrere Zonen, und HTTP-Health-Checks auf Anwendungsebene ermöglichen die Selbstreparatur nach drei fehlgeschlagenen Prüfungen von je 10 Sekunden. Der globale Load Balancer entfernt automatisch fehlerhafte VMs und leitet den Datenverkehr auf fehlerfreie Zonen um.
    • Befehle:

undefined

undefined

  1. Aktivieren Sie Cloud SQL HA mit regionenübergreifendem Lesereplikat und PITR
    • Begründung: Regionale HA bietet zonale Ausfallsicherheit mit automatischem Failover. Ein Lesereplikat in us-east1 ermöglicht regionales DR mit einem RPO, das zwar nicht null, aber begrenzt ist. Die Aktivierung von PITR (binäres Logging für MySQL) begegnet logischer Datenkorruption, indem eine Wiederherstellung zu einem bestimmten Zeitpunkt ermöglicht wird.
    • Befehle:

undefined

undefined

  1. Schützen Sie Objektdaten mit Dual-Region Cloud Storage und Lebenszyklusrichtlinien

    • Begründung: Produktbilder und statische Inhalte werden für regionale Resilienz in einem Dual-Region-Bucket gespeichert. Lebenszyklus-Übergänge verschieben ältere Artefakte nach Coldline, um die Kosten zu optimieren, und Versionierung sowie Aufbewahrungsrichtlinien verhindern das versehentliche Löschen kritischer Assets.
    • Schritte: Aktivieren Sie die Objektversionierung (Object Versioning), legen Sie eine 30-tägige Aufbewahrungsrichtlinie für kritische Buckets fest und wenden Sie Lebenszyklusregeln an, um nicht kritische Build-Artefakte nach 90 Tagen nach Coldline zu verschieben und nach einem Jahr zu löschen.
  2. Planen Sie PD-Snapshots und erstellen Sie Maschinen-Images für zustandsbehaftete Dienste

    • Begründung: Inkrementelle Snapshots von VM-Festplatten bieten schnelle, absturzkonsistente Wiederherstellungsoptionen. Maschinen-Images erfassen Boot- und Konfigurationsdaten, um die Wiederherstellung von App-Servern während eines regionalen Failovers zu beschleunigen. Snapshot-Zeitpläne gewährleisten konsistente, richtliniengesteuerte Backups.
    • Befehle:

undefined

undefined

undefined

  1. Definieren Sie RTO/RPO und kodifizieren Sie DR-Runbooks und IaC

    • Begründung: Legen Sie ein Service-Level-RTO von 15 Minuten für Web/API und ein RPO von vier Stunden für Bestellungen fest. Runbooks spezifizieren die Vorgehensweisen für das Traffic-Failover, die Heraufstufung (Promotion) des Cloud SQL-Lesereplikats, DNS-Notfallpläne und Verifizierungsschritte. Infrastructure as Code (Terraform/Deployment Manager) gewährleistet deterministische Wiederherstellungen und reduziert manuelle Fehler.
  2. Stellen Sie Kapazität und Kontingente in der sekundären Region bereit

    • Begründung: Erstellen Sie Reservierungen für kritische VM-Typen, stellen Sie ein Standby-Load-Balancer-Backend, SSL-Zertifikate und NAT-Kapazität vorab bereit und überprüfen Sie die Kontingente für Compute, SQL, Weiterleitungsregeln und KMS in us-east1. Dies verhindert Kapazitätsengpässe während eines Failovers.
  3. Validieren Sie die Wiederherstellung durch Chaos-Übungen und dokumentieren Sie Verbesserungen

    • Begründung: Vierteljährliche Übungen zu zonalen Ausfällen validieren das Verhalten von MIG und LB; halbjährliche regionale Evakuierungen stufen das Lesereplikat in us-east1 herauf, leiten den globalen LB auf die Backends in us-east1 um und messen RTO/RPO. Die Ergebnisse führen zu Verbesserungen, wie z. B. der Reduzierung manueller Schritte oder der Erhöhung der Replikatkapazität.

Durch die Befolgung dieser Schritte erreicht Brightlane Retail eine zonale Hochverfügbarkeit mit automatisierter Selbstreparatur und eine regionale DR-Strategie mit definierten, getesteten Runbooks. Dadurch wird sichergestellt, dass die Bestelldaten ein RPO von vier Stunden einhalten und die Anwendungsdienste innerhalb der angestrebten RTO-Grenzen wiederhergestellt werden.


Sicherheit · Alle Domänen · Kostenmanagement

Diese Fragen üben → · Zeitlich begrenzte Übung auf ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Bestehe deine Prüfung →

Google durchsuchen →

Related guides

All-in-One Zugang

Ein Abonnement. Jede Prüfung.

Jeder Plan schaltet unbegrenzte Antwortsuche, Übungstests, KI-Erklärungen und die vollständige Ressourcenbibliothek frei – in über 20 Sprachen.

Monatlich
24.87
Just €0.83/day
Alles inklusive:
  • Unbegrenzte Antwortsuche
  • Unbegrenzte Übungstests
  • KI-gestützte Erklärungen
  • Vollständige Ressourcenbibliothek
  • Über 20 Sprachen
  • Wöchentliche Inhaltsaktualisierungen
  • Belohnungen & Empfehlungen
  • Priorisierter Support
Kostenlose Testphase starten

Keine Kreditkarte erforderlich*

Bestes Preis-Leistungs-Verhältnis
12 Monate
179.87
Just €0.49/daySave 40%
Alles inklusive:
  • Unbegrenzte Antwortsuche
  • Unbegrenzte Übungstests
  • KI-gestützte Erklärungen
  • Vollständige Ressourcenbibliothek
  • Über 20 Sprachen
  • Wöchentliche Inhaltsaktualisierungen
  • Belohnungen & Empfehlungen
  • Priorisierter Support
Kostenlose Testphase starten

Keine Kreditkarte erforderlich*

✓ Kostenloser Plan enthalten · ✓ Jederzeit kündbar · ✓ Alle Pläne schalten das vollständige Produkt frei