Google PCNE: Osservabilità della rete, affidabilità e risoluzione dei problemi — Guida allo studio

Fa parte della Google Professional Cloud Network Engineer — Guida allo studio. Esercitati con risposte verificate nel centro esami Google, oppure fai test cronometrati su ExamRoll.io.

Panoramica

L’osservabilità della rete su Google Cloud è la raccolta, la correlazione e l’analisi disciplinata dei segnali di rete che descrivono la raggiungibilità, le prestazioni e la correttezza attraverso VPC, bilanciatori di carico, connessioni ibride e servizi. L’affidabilità deriva dalla progettazione orientata al rilevamento dei guasti e a una risoluzione sicura: strumentare una telemetria di prima classe, validare il control plane prima di intervenire sul data plane, approfondire con l’analisi dei pacchetti solo quando necessario e automatizzare il rollback. Questa sezione spiega come utilizzare gli strumenti e i pattern di Google Cloud per rilevare, diagnosticare e prevenire problemi, minimizzando al contempo il rischio durante le modifiche.

Flow Logs, Logging, Monitoring, Metriche e SLO

I VPC Flow Logs forniscono una telemetria campionata e aggregata a livello della NIC della VM, dopo la valutazione del firewall VPC. Non sono catture complete dei pacchetti e non sostituiscono il logging delle regole firewall per una prova esplicita di autorizzazione/negazione (allow/deny). Controlli chiave:

Abilitazione tipica su una subnet:

undefined

Esportazione con i log sink per analisi durevoli e condivisione tra progetti:

undefined

Il logging delle regole firewall integra i flow log registrando le decisioni di autorizzazione/negazione (allow/deny) e le regole che hanno prodotto una corrispondenza. Per osservare il traffico bloccato, aggiungere una regola di negazione totale (deny-all) con logging abilitato verso la fine del set di regole:

undefined

Cloud Logging permette query strutturate, la correlazione con i log delle richieste, i log degli health check, i log NAT e i log dei bilanciatori di carico. Creare metriche basate su log per segnali come:

Cloud Monitoring aggrega le metriche e fornisce dashboard, avvisi e SLO:

Compromessi e modalità di guasto:

Network Intelligence Center e Diagnostica Avanzata

Il Network Intelligence Center (NIC) fornisce una diagnostica proattiva e strutturata:

Test di connettività:

Dashboard delle prestazioni:

Topologia di rete:

Firewall Insights:

Network Analyzer:

Guida operativa:

Packet Mirroring, Load Balancer e Telemetria Ibrida

Packet Mirroring:

Log dei load balancer e prove degli health check:

Telemetria di VPN e Interconnect:

Metodologia di Troubleshooting, Gestione degli Incidenti e Affidabilità Proattiva

Troubleshooting strutturato dal DNS all’applicazione:

  1. Identificare il percorso utente che presenta errori e la finestra temporale; circoscrivere l’analisi alla region e al percorso (pubblico tramite LB, privato tramite VPC o ibrido).
  2. DNS:
  1. Load balancer e edge:
  1. Routing e firewall:
  1. Egress verso le API di Google:
  1. Ibrido:
  1. Evidenza a livello di pacchetto:

Gestione degli incidenti:

Pianificazione della capacità e affidabilità proattiva:

Scenario Pratico di un Problema

Contoso Games gestisce un’API di gioco globale con load balancing HTTP(S) in us-east1 e europe-west1, con una VPN ad alta disponibilità (HA) verso un data center on-premise. Gli utenti in Europa segnalano timeout intermittenti e latenza più alta dopo una recente modifica al firewall. Le istanze non hanno IP esterni e devono raggiungere le API di Google privatamente.

Approccio:

  1. Stabilire la finestra temporale e l’impatto sugli SLO
  1. Validare il piano di controllo con Connectivity Tests
  1. Confermare lo stato di salute dell’edge e dei backend tramite i log
  1. Ripristinare lo stato di salute e garantire la sicurezza con modifiche mirate
  1. Ristabilire l’egress privato verso le API di Google
  1. Controllare la saturazione e l’MTU dell’ambiente ibrido
  1. Usare la modalità di anteprima di Cloud Armor per sospetti client abusivi
  1. Usare Packet Mirroring in modo mirato per confermare il comportamento del piano dati
  1. Chiudere l’incidente e rafforzare il sistema (harden)

Questa sequenza dimostra un flusso di lavoro sicuro e basato sull’evidenza: confermare il piano di controllo, osservare il piano dati, applicare modifiche minime e reversibili, e infine istituzionalizzare gli insegnamenti appresi con alert e controlli automatizzati.


GKE · Tutti i domini · Automazione della rete

Esercitati su queste domande → · Pratica cronometrata su ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Supera l'esame →

Sfoglia Google →

Related guides

Accesso tutto incluso

Un abbonamento. Ogni esame.

Ogni piano sblocca la ricerca illimitata di risposte, test pratici, spiegazioni AI e la libreria completa di risorse — in oltre 20 lingue.

Mensile
24.87
Just €0.83/day
Tutto incluso:
  • Ricerca risposte illimitata
  • Test pratici illimitati
  • Spiegazioni basate su AI
  • Libreria completa di risorse
  • Oltre 20 lingue
  • Aggiornamenti settimanali dei contenuti
  • Premi e referral
  • Supporto prioritario
Inizia la prova gratuita

Nessuna carta di credito richiesta*

Miglior valore
12 mesi
179.87
Just €0.49/daySave 40%
Tutto incluso:
  • Ricerca risposte illimitata
  • Test pratici illimitati
  • Spiegazioni basate su AI
  • Libreria completa di risorse
  • Oltre 20 lingue
  • Aggiornamenti settimanali dei contenuti
  • Premi e referral
  • Supporto prioritario
Inizia la prova gratuita

Nessuna carta di credito richiesta*

✓ Piano gratuito incluso · ✓ Annulla in qualsiasi momento · ✓ Tutti i piani sbloccano il prodotto completo