Google PCA: Affidabilità, disaster recovery e continuità operativa — Guida allo studio

Fa parte della Google Professional Cloud Architect — Guida allo studio. Esercitati con risposte verificate nel centro esami Google, oppure fai test cronometrati su ExamRoll.io.

Panoramica

Affidabilità, Disaster Recovery (DR) e continuità operativa garantiscono che i servizi continuino a soddisfare gli obiettivi concordati nonostante guasti a livello di componente, zona o region. Su Google Cloud, l’affidabilità viene progettata comprendendo i domini di errore (zonali, regionali e globali), definendo gli obiettivi di ripristino (RTO/RPO), selezionando architetture di servizio resilienti (ad es. attivo-attivo) e testando rigorosamente i piani di ripristino. La tua progettazione deve mappare la criticità del servizio a obiettivi di disponibilità espliciti, garanzie di durabilità e percorsi di ripristino convalidati, bilanciando disponibilità, coerenza, costi e complessità operativa. I temi chiave includono l’isolamento dei singoli punti di guasto (single point of failure), l’uso della replica gestita dove possibile, l’automazione delle decisioni di failover e la convalida continua che le ipotesi rimangano valide in condizioni simili a quelle di produzione.

Domini di errore, località e servizi multi-regionali

Compromessi:

Obiettivi, mappatura delle dipendenze e convalida del DR

Pattern resilienti per Compute, Database e Storage

    gcloud compute firewall-rules create allow-lb-health-checks \
      --network=prod-vpc --action=ALLOW --direction=INGRESS \
      --rules=tcp:80,tcp:443 \
      --source-ranges=130.211.0.0/22,35.191.0.0/16 \
      --target-tags=web-backend
    ```

  - Evitare lo stato locale; esternalizzare le sessioni su Memorystore o database; utilizzare il connection draining sui backend per preservare le richieste in transito (in-flight) durante lo scale-in.
  - Modalità di guasto comuni: health check non allineati (che controllano troppo o troppo poco), regole firewall mancanti e bootstrapping che dipende da servizi a valle (downstream) non integri.
- Resilienza di Cloud SQL:
  - Alta disponibilità (High availability): istanza primaria e di standby in zone separate con replica sincrona del disco e failover automatico; selezionare una finestra di manutenzione e testare i failover.
  - Repliche di lettura (Read replicas): aggiungere repliche di lettura nella stessa regione o cross-region per scaricare le letture e ridurre l'RTO in caso di eventi regionali; promuovere le repliche durante il DR (Disaster Recovery).
  - Backup e PITR:
    - Abilitare i backup giornalieri automatici e il point-in-time recovery (PITR) tramite log binari/di transazione con una conservazione (retention) sufficiente per la conformità e l'RPO.
    - Convalidare i ripristini in ambienti non di produzione ed esercitarsi con le procedure di promozione e gli aggiornamenti delle stringhe di connessione dell'applicazione.
  - Rete: preferire l'IP privato per la produzione; assicurarsi che i test di failover convalidino il comportamento del DNS e del connection pooling.
  - Suggerimento operativo: eseguire periodicamente un failover controllato per verificare che i pool di connessioni dell'applicazione si ricolleghino correttamente.
gcloud sql instances failover prod-sql
```
    {
      "rule": [
        {
          "action": { "type": "Delete" },
          "condition": { "age": 90, "isLive": false }
        }
      ]
    }
    ```

    Applicare con:
gsutil lifecycle set lifecycle.json gs://prod-backups
```

Gestione del traffico, strategie multi-sito e resilienza continua

Scenario pratico

Acme Tickets, un’azienda di biglietteria online in rapida crescita, deve garantire la continuità operativa durante le interruzioni regionali per la sua API di acquisto e il catalogo eventi, mantenendo al contempo RTO/RPO rigorosi (RTO ≤ 5 minuti, RPO ≤ 1 minuto). Lo stack include microservizi stateless, un database relazionale per gli ordini, una pipeline di analisi e asset multimediali statici.

  1. Definire i livelli di servizio (tier), gli SLO e gli obiettivi di ripristino
  1. Scegliere il posizionamento regionale e la strategia multi-sito
  1. Implementare MIG regionali e load balancing HTTP(S) globale
  1. Esternalizzare lo stato e configurare l’autoriparazione (self-healing)
  1. Provisionare Cloud SQL for PostgreSQL con HA e read replica cross-region
  1. Pianificare test di failover di routine per il database
  1. Posizionare gli asset multimediali statici in un bucket Cloud Storage dual-region con versioning e retention
  1. Proteggere gli health check e il traffico in uscita (egress) con firewall e quote
  1. Implementare il DNS come controllo approssimativo con TTL basso
  1. Automatizzare i runbook di DR e convalidarli tramite game day
  1. Mettere in sicurezza e separare i backup
  1. Implementare il degrado graduale (graceful degradation)

Questa architettura fornisce un failover regionale automatizzato per i servizi stateless, un failover controllato e testato per i componenti stateful e processi di ripristino verificati che soddisfano gli obiettivi di continuità operativa di Acme Tickets.


Sicurezza · Tutti i domini · Migrazione

Esercitati su queste domande → · Pratica cronometrata su ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Supera l'esame →

Sfoglia Google →

Related guides

Accesso tutto incluso

Un abbonamento. Ogni esame.

Ogni piano sblocca la ricerca illimitata di risposte, test pratici, spiegazioni AI e la libreria completa di risorse — in oltre 20 lingue.

Mensile
24.87
Just €0.83/day
Tutto incluso:
  • Ricerca risposte illimitata
  • Test pratici illimitati
  • Spiegazioni basate su AI
  • Libreria completa di risorse
  • Oltre 20 lingue
  • Aggiornamenti settimanali dei contenuti
  • Premi e referral
  • Supporto prioritario
Inizia la prova gratuita

Nessuna carta di credito richiesta*

Miglior valore
12 mesi
179.87
Just €0.49/daySave 40%
Tutto incluso:
  • Ricerca risposte illimitata
  • Test pratici illimitati
  • Spiegazioni basate su AI
  • Libreria completa di risorse
  • Oltre 20 lingue
  • Aggiornamenti settimanali dei contenuti
  • Premi e referral
  • Supporto prioritario
Inizia la prova gratuita

Nessuna carta di credito richiesta*

✓ Piano gratuito incluso · ✓ Annulla in qualsiasi momento · ✓ Tutti i piani sbloccano il prodotto completo