Amazon SOA-C02: Alta disponibilità, tolleranza ai guasti e ripristino di emergenza — Guida allo studio

Fa parte della AWS SysOps Administrator Associate SOA-C02 — Guida allo studio. Esercitati con risposte verificate nel centro esami Amazon, oppure fai test cronometrati su ExamRoll.io.

Meccanismi di failover (health check di Route53, automatizzati)

Il failover automatizzato utilizza health check, policy di routing e orchestrazione. Route53 supporta health check e routing di tipo failover, ponderato (weighted) e basato sulla latenza (latency). Configurare gli health check di Route53 per sondare gli endpoint (HTTP, TCP o allarmi CloudWatch) e un set di record di failover che commuta su una risorsa secondaria quando quella primaria fallisce. Esempio di aggiornamento tramite CLI: aws route53 change-resource-record-sets –hosted-zone-id Z123456 –change-batch file://changes.json. Utilizzare gli allarmi CloudWatch (le azioni degli allarmi attivano AWS Lambda) per orchestrare il failover per azioni non legate al DNS.

Integrare Load Balancer e Auto Scaling: gli health check dei target group di ALB/NLB rimuovono le istanze non integre (unhealthy), mentre Auto Scaling le sostituisce automaticamente. Per il failover dei database, affidarsi a meccanismi a livello di servizio: RDS Multi-AZ o il failover automatizzato di Aurora, e per la promozione cross-region utilizzare le repliche di lettura (read replicas) o la promozione controllata di Aurora Global DB.

Due modelli operativi:

Pianificazione, test e validazione di RTO/RPO

L’RTO è il tempo massimo di inattività accettabile; l’RPO è la perdita massima di dati accettabile. Definire obiettivi misurabili per ogni workload e allineare le scelte architetturali: la replica sincrona riduce l’RPO ma può aumentare la latenza; la replica asincrona riduce i costi ma aumenta la potenziale finestra di perdita dati. Tradurre gli SLA di business in frequenza di conservazione (retention) e di replica: RPO = ritardo di replica (replication lag) + intervallo di backup; RTO = tempo di rilevamento + tempo di orchestrazione del failover + tempo di validazione del ripristino.

Il testing è essenziale: eseguire esercitazioni di DR (Disaster Recovery) pianificate che convalidino le procedure di ripristino, il failover DNS e l’integrità dell’applicazione. Convalidare i backup ripristinandoli in un account o VPC isolato (usare CloudFormation/CloudFormation StackSets o Terraform per automatizzare le ricostruzioni). Raccogliere metriche durante i test (tempo di propagazione DNS, punto di ripristino, controlli a livello di applicazione) e iterare sull’automazione per ridurre l’RTO.

Errori Comuni e Criteri Decisionali

Problema Pratico: Scenario d’Uso

AcmePayments gestisce un’API di transazione soggetta a PCI in us-east-1 e necessita di un RTO < 5 minuti e un RPO quasi nullo per i dati transazionali core durante un’interruzione regionale.

  1. Definire RTO=5 min e RPO≈0 selezionando Aurora Global Database con un’istanza primaria scrivibile in us-east-1 e una secondaria in eu-west-1 per una rapida replica cross-region.
  2. Abilitare il Multi-AZ sincrono/per-regione per l’HA intra-regionale (repliche Aurora + Multi-AZ) e pubblicare il DNS tramite Route53 con health check e un TTL basso (60s) per il routing di failover.
  3. Utilizzare snapshot automatizzati cross-region e copie nel vault di AWS Backup come ulteriore copia immutabile con retention e vault lock.
  4. Automatizzare il playbook di failover con Step Functions e Lambda per convalidare la promozione della replica, aggiornare i record di Route53 (aws route53 change-resource-record-sets), eseguire smoke test e fare rollback in caso di fallimenti.
  5. Pianificare esercitazioni di DR trimestrali ripristinando i backup in un VPC isolato e misurare RTO e RPO effettivi, quindi affinare l’automazione e le policy di scaling.

Logica: la combinazione di un prodotto DB globale a bassa latenza (Aurora Global) con un routing basato su DNS e un’orchestrazione automatizzata soddisfa RTO/RPO stringenti, mantenendo al contempo i passaggi operativi ripetibili e testabili. La validazione regolare garantisce che i backup e le repliche siano effettivamente recuperabili.


Monitoraggio · Tutti i domini · Distribuzione

Esercitati su queste domande → · Pratica cronometrata su ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Supera l'esame →

Sfoglia Amazon →

Related guides

Accesso tutto incluso

Un abbonamento. Ogni esame.

Ogni piano sblocca la ricerca illimitata di risposte, test pratici, spiegazioni AI e la libreria completa di risorse — in oltre 20 lingue.

Mensile
24.87
Just €0.83/day
Tutto incluso:
  • Ricerca risposte illimitata
  • Test pratici illimitati
  • Spiegazioni basate su AI
  • Libreria completa di risorse
  • Oltre 20 lingue
  • Aggiornamenti settimanali dei contenuti
  • Premi e referral
  • Supporto prioritario
Inizia la prova gratuita

Nessuna carta di credito richiesta*

Miglior valore
12 mesi
179.87
Just €0.49/daySave 40%
Tutto incluso:
  • Ricerca risposte illimitata
  • Test pratici illimitati
  • Spiegazioni basate su AI
  • Libreria completa di risorse
  • Oltre 20 lingue
  • Aggiornamenti settimanali dei contenuti
  • Premi e referral
  • Supporto prioritario
Inizia la prova gratuita

Nessuna carta di credito richiesta*

✓ Piano gratuito incluso · ✓ Annulla in qualsiasi momento · ✓ Tutti i piani sbloccano il prodotto completo