Microsoft AZ-104: Azure Monitor, Backup e Site Recovery — Guia de estudos

Faz parte do Microsoft Azure Administrator Associate AZ-104 — Guia de estudos. Pratique com respostas verificadas no centro de exames da Microsoft, ou faça testes cronometrados no ExamRoll.io.

Visão Geral

A excelência operacional no Azure exige que três pilares trabalhem em conjunto: telemetria observável, dados recuperáveis e planos de continuidade resilientes. O Azure Monitor e sua base no Log Analytics coletam métricas e logs de alta fidelidade, acionam alertas inteligentes e expõem o desempenho da aplicação. O Azure Backup protege dados da plataforma e de IaaS com recuperação orientada por políticas e baseada em cofre, incluindo capacidades de restauração instantânea para tempo de inatividade mínimo. O Azure Site Recovery (ASR) replica cargas de trabalho para sites alternativos e orquestra o failover e o failback para atender aos RPO/RTO de negócio. Serviços complementares — Network Watcher para diagnósticos de rede e Azure Service Health para conscientização da plataforma — completam um kit de ferramentas completo para o administrador.

Azure Monitor e Log Analytics

O Azure Monitor unifica métricas e logs da plataforma. Métricas são séries temporais numéricas otimizadas para análise quase em tempo real (alta cardinalidade, multidimensionais, granularidade de um minuto para a maioria dos recursos). Use o Metrics Explorer para visualização e alertas de métrica quase em tempo real com limiares estáticos ou dinâmicos. Logs são registros com esquema rico armazenados em um workspace do Log Analytics, consultados com a Kusto Query Language (KQL) para investigação, dashboards e alertas agendados (de log).

As configurações de diagnóstico são a ponte dos recursos para os destinos de telemetria. Em cada recurso do Azure, configure as configurações de diagnóstico para escolher categorias (métricas da plataforma, logs da plataforma e logs de recursos) e encaminhá-las para um ou mais destinos:

Projete os workspaces do Log Analytics de forma deliberada:

O domínio do KQL é essencial. Exemplos:

undefined

undefined

undefined

Grupos de ação definem quem e o que responde aos alertas: e-mail/SMS/push/voz, webhooks seguros, conectores ITSM, Functions, Logic Apps e runbooks de Automação. Reutilize grupos de ação entre regras de alerta e imponha um roteamento de incidentes consistente.

O Azure Monitor suporta múltiplos tipos de alerta:

Application Insights e Alertas

O Application Insights instrumenta o código e a plataforma para fornecer telemetria de aplicação de ponta a ponta. Use connection strings e SDKs de primeira classe (.NET, Java, Node.js, Python) ou OpenTelemetry para rastreamento neutro em relação ao fornecedor. Para serviços PaaS (App Service, Functions, AKS), habilite a auto-instrumentação onde disponível para capturar requisições, dependências, exceções e rastreamentos sem alterações no código. Mantenha o contexto de rastreamento distribuído para correlacionar os saltos entre cliente, API e backend.

Principais tipos de telemetria:

Aplique a amostragem adaptativa para controlar o volume de ingestão sem perder a fidelidade do sinal, e use o Live Metrics Stream para insights de baixa latência durante incidentes.

Testes de disponibilidade validam a alcançabilidade externa e o SLA:

Aumente os alertas com a detecção inteligente no Application Insights para:

Azure Backup

Um cofre dos Recovery Services centraliza o gerenciamento de backup, as políticas e a recuperação. Posicione os cofres na mesma região dos recursos protegidos (ou na região emparelhada para cenários de restauração entre regiões suportados pelo serviço). Reforce a segurança dos cofres com exclusão reversível (soft delete), proteção contra limpeza (purge protection) e autorização multiusuário para operações críticas.

As políticas de backup definem agendamentos e retenção:

O Instant Restore acelera a recuperação de VMs usando snapshots armazenados localmente, retidos por um curto período antes do armazenamento profundo no cofre. Os administradores podem:

As considerações sobre o backup de VMs incluem a exclusão de discos para dados não críticos, o tratamento da criptografia (o Azure Backup suporta discos criptografados) e os modelos de consistência (consistente com falhas vs. consistente com a aplicação). O backup do Azure Files utiliza snapshots de armazenamento, beneficiando-se da retenção incremental, eficiente em espaço e da proteção de exclusão reversível (soft delete). O backup do SQL em VMs do Azure usa uma extensão ciente da carga de trabalho (workload-aware), coordenada pelo cofre, para produzir cadeias de backup compatíveis e restauráveis em grupos de disponibilidade Always On e instâncias autônomas (standalone).

Azure Site Recovery, Network Watcher e Service Health

O ASR fornece replicação de cargas de trabalho e recuperação orquestrada:

As metas de RPO/RTO orientam a política:

O Azure Network Watcher equipa os administradores com diagnósticos de rede precisos:

O Azure Service Health complementa o monitoramento com a conscientização da plataforma:

Cenário de Problema Prático

A Adobe precisa fortalecer (harden) e operacionalizar uma nova plataforma de e-commerce em duas regiões no Azure, atendendo a objetivos rigorosos de observabilidade, backup e recuperação de desastres, garantindo ao mesmo tempo a rápida solução de problemas de rede e a conscientização sobre a plataforma.

  1. Implantar um workspace central do Log Analytics por região e anexar Regras de Coleta de Dados (Data Collection Rules) a todas as VMs e nós do AKS para coletar logs de desempenho, syslog/EventLog e logs específicos de recursos por meio de configurações de diagnóstico. Por quê: Workspaces regionais preservam a residência e o desempenho dos dados; a combinação AMA+DCR fornece coleta granular e escalável com controle de custos.

  2. Configurar as definições de diagnóstico no App Service, Key Vault, Azure Firewall, Application Gateway e Storage para encaminhar logs e métricas para o workspace regional e para uma conta de armazenamento para retenção de longo prazo. Por quê: A análise centralizada permite a correlação entre recursos; a retenção em armazenamento atende a necessidades de conformidade e forenses.

  3. Instrumentar as camadas web e de API com o Application Insights usando OpenTelemetry e habilitar a auto-instrumentação no App Service. Criar testes de disponibilidade de pelo menos cinco regiões do Azure com verificações de correspondência de conteúdo e de expiração de TLS. Por quê: O rastreamento distribuído profundo e os testes sintéticos detectam regressões que impactam o usuário antes que os clientes o façam.

  4. Criar alertas do Azure Monitor:

  1. Proteger os dados com o Azure Backup:
  1. Implementar o Azure Site Recovery para DR de região para região das camadas web, de API e de SQL com uma política de replicação visando um RPO baixo e pontos consistentes com o aplicativo a cada hora. Construir um plano de recuperação com camadas (dados primeiro, depois API, depois web), automação para atualizar o DNS e limpar caches da CDN, e testar o failover em uma VNet isolada trimestralmente. Por quê: A replicação e os planos de recuperação do ASR fornecem um RTO previsível com runbooks orquestrados e auditáveis e testes não disruptivos.

  2. Habilitar o Network Watcher e usar a Solução de problemas de conexão (Connection troubleshoot) para validar os fluxos do frontend para o backend, o Próximo salto (Next hop) para verificar as UDRs através da camada de NVA e a Verificação de fluxo de IP (IP flow verify) para confirmar o fortalecimento (hardening) do NSG. Configurar a captura de pacotes sob demanda nas VMs da API para análise de timeouts intermitentes. Por quê: Diagnósticos específicos isolam rapidamente problemas de roteamento/NSG e fornecem evidências em nível de pacote quando necessário.

  3. Criar alertas do Azure Service Health para as duas regiões e os serviços no escopo (App Service, SQL, Storage, Key Vault, Front Door). Encaminhá-los para os mesmos grupos de ações e incluir listas de distribuição da liderança para avisos de manutenção planejada. Por quê: A conscientização proativa sobre incidentes e manutenções da plataforma evita interrupções inesperadas e permite uma comunicação coordenada.

Essa abordagem integrada garante que a Adobe atinja suas metas de RPO/RTO, se recupere rapidamente de ransomware ou erro do operador, detecte e corrija anomalias em minutos e possa solucionar conclusivamente os caminhos de rede, mantendo-se informada sobre os eventos da plataforma Azure.


Bancos de Dados do Azure e Serviços de Dados · Todos os domínios · Segurança e Conformidade do Azure

Pratique estas questões → · Prática cronometrada no ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Passe no seu exame →

Navegar Microsoft →

Related guides

Acesso completo

Uma assinatura. Todos os exames.

Todo plano desbloqueia pesquisa ilimitada de respostas, testes práticos, explicações de AI e a biblioteca completa de recursos — em mais de 20 idiomas.

Mensal
24.87
Just €0.83/day
Tudo incluído:
  • Pesquisa ilimitada de respostas
  • Testes práticos ilimitados
  • Explicações com AI
  • Biblioteca completa de recursos
  • Mais de 20 idiomas
  • Atualizações semanais de conteúdo
  • Recompensas e indicações
  • Suporte prioritário
Iniciar teste grátis

*Não é necessário cartão de crédito

Melhor custo-benefício
12 meses
179.87
Just €0.49/daySave 40%
Tudo incluído:
  • Pesquisa ilimitada de respostas
  • Testes práticos ilimitados
  • Explicações com AI
  • Biblioteca completa de recursos
  • Mais de 20 idiomas
  • Atualizações semanais de conteúdo
  • Recompensas e indicações
  • Suporte prioritário
Iniciar teste grátis

*Não é necessário cartão de crédito

✓ Plano gratuito incluído · ✓ Cancele a qualquer momento · ✓ Todos os planos desbloqueiam o produto completo