Google PCNE: Observabilidade de Rede, Confiabilidade e Solução de Problemas — Guia de estudos

Faz parte do Google Professional Cloud Network Engineer — Guia de estudos. Pratique com respostas verificadas no centro de exames da Google, ou faça testes cronometrados no ExamRoll.io.

Visão Geral

A observabilidade de rede no Google Cloud é a coleta, correlação e análise disciplinada de sinais de rede que descrevem a alcançabilidade, o desempenho e a correção entre VPCs, balanceadores de carga, conexões híbridas e serviços. A confiabilidade resulta de um projeto que prevê a detecção de falhas e a remediação segura: instrumentar telemetria de primeira classe, validar o plano de controle antes de tocar no plano de dados, aprofundar a análise com evidências de pacotes apenas quando necessário e automatizar o rollback. Esta seção explica como usar as ferramentas e os padrões do Google Cloud para detectar, diagnosticar e prevenir problemas, minimizando o risco durante as mudanças.

Flow Logs, Logging, Monitoring, Metrics e SLOs

Os VPC Flow Logs fornecem telemetria amostrada e agregada na NIC da VM após a avaliação do firewall da VPC. Eles não são capturas de pacotes completas e não substituem o logging de regras de firewall para evidências explícitas de permissão (allow) ou negação (deny). Controles principais:

Habilitação típica em uma sub-rede (subnet):

undefined

Exporte com coletores de logs (log sinks) para análise durável e compartilhamento entre projetos:

undefined

O logging de regras de firewall complementa os flow logs registrando as decisões de permissão/negação e as regras correspondentes. Para observar o tráfego bloqueado, adicione uma regra de negação total (deny-all) com logging próximo ao final do seu conjunto de regras:

undefined

O Cloud Logging permite consultas estruturadas e correlação com logs de requisição, logs de verificação de saúde (health-check), logs de NAT e logs de balanceador de carga (load-balancer). Crie métricas baseadas em logs para sinais como:

O Cloud Monitoring agrega métricas e fornece dashboards, alertas e SLOs:

Compromissos e modos de falha:

Network Intelligence Center e Diagnósticos Avançados

O Network Intelligence Center (NIC) fornece diagnósticos proativos e estruturados:

Connectivity Tests:

Performance Dashboard:

Network Topology:

Firewall Insights:

Network Analyzer:

Orientação operacional:

Espelhamento de Pacotes, Balanceadores de Carga e Telemetria Híbrida

Packet Mirroring:

Logs de balanceador de carga e evidências de verificação de integridade:

Telemetria de VPN e Interconnect:

Metodologia de Solução de Problemas, Gerenciamento de Incidentes e Confiabilidade Proativa

Solução de problemas estruturada do DNS à aplicação:

  1. Identifique a jornada do usuário que está falhando e a janela de tempo; localize a região e o caminho (público via LB, privado via VPC ou híbrido).
  2. DNS:
  1. Balanceador de carga e borda:
  1. Roteamento e firewall:
  1. Saída (egress) para APIs do Google:
  1. Híbrido:
  1. Evidência de pacotes:

Gerenciamento de incidentes:

Planejamento de capacidade e confiabilidade proativa:

Cenário de Problema Prático

A Contoso Games opera uma API de jogos global com balanceamento de carga HTTP(S) em us-east1 e europe-west1, com HA VPN para um data center on-premise. Usuários na Europa relatam timeouts intermitentes e latência mais alta após uma recente alteração no firewall. As instâncias não têm IPs externos e devem acessar as APIs do Google de forma privada.

Abordagem:

  1. Estabelecer a janela de tempo e o impacto no SLO
  1. Validar o plano de controle com o Connectivity Tests
  1. Confirmar a saúde da borda e do backend via logs
  1. Restaurar a saúde e proteger a segurança com alterações de escopo limitado
  1. Restabelecer a saída privada para as APIs do Google
  1. Verificar a saturação do ambiente híbrido e o MTU
  1. Usar o modo de visualização (preview) do Cloud Armor para clientes suspeitos de abuso
  1. Usar o Packet Mirroring de forma restrita para confirmar o comportamento do plano de dados
  1. Encerrar o incidente e fortalecer o ambiente (harden)

Esta sequência demonstra um fluxo de trabalho seguro e orientado por evidências: confirmar o plano de controle, observar o plano de dados, aplicar alterações mínimas e reversíveis e, em seguida, institucionalizar os aprendizados com alertas e verificações automatizadas.


GKE · Todos os domínios · Automação de Rede

Pratique estas questões → · Prática cronometrada no ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Passe no seu exame →

Navegar Google →

Related guides

Acesso completo

Uma assinatura. Todos os exames.

Todo plano desbloqueia pesquisa ilimitada de respostas, testes práticos, explicações de AI e a biblioteca completa de recursos — em mais de 20 idiomas.

Mensal
24.87
Just €0.83/day
Tudo incluído:
  • Pesquisa ilimitada de respostas
  • Testes práticos ilimitados
  • Explicações com AI
  • Biblioteca completa de recursos
  • Mais de 20 idiomas
  • Atualizações semanais de conteúdo
  • Recompensas e indicações
  • Suporte prioritário
Iniciar teste grátis

*Não é necessário cartão de crédito

Melhor custo-benefício
12 meses
179.87
Just €0.49/daySave 40%
Tudo incluído:
  • Pesquisa ilimitada de respostas
  • Testes práticos ilimitados
  • Explicações com AI
  • Biblioteca completa de recursos
  • Mais de 20 idiomas
  • Atualizações semanais de conteúdo
  • Recompensas e indicações
  • Suporte prioritário
Iniciar teste grátis

*Não é necessário cartão de crédito

✓ Plano gratuito incluído · ✓ Cancele a qualquer momento · ✓ Todos os planos desbloqueiam o produto completo