Microsoft AZ-305: Monitoramento, Otimização de Custos e Operações — Guia de estudos
Faz parte do Microsoft Azure Solutions Architect Expert AZ-305 — Guia de estudos. Pratique com respostas verificadas no centro de exames da Microsoft, ou faça testes cronometrados no ExamRoll.io.
Visão Geral
Um design robusto de monitoramento e operações do Azure estabelece uma malha única de telemetria, alertas acionáveis, custos governados e relatórios de conformidade para toda a frota. A solução abrange as métricas e logs do Azure Monitor, o Log Analytics e a Kusto Query Language (KQL), o Application Insights para telemetria de aplicações e a governança operacional por meio do Azure Policy, Azure Resource Graph e Advisor. O controle de custos é reforçado pelo Azure Cost Management, enquanto a confiabilidade da plataforma e a ciência sobre mudanças dependem do Azure Service Health. O Azure Automation fecha o ciclo com remediação repetível e orquestração de atualizações. Os Workbooks unificam os insights desses serviços para proporcionar visibilidade operacional.
Observabilidade com Azure Monitor, Application Insights e Workbooks
O Azure Monitor coleta telemetria da plataforma e das cargas de trabalho, armazenando métricas de série temporal e dados de log. As métricas são valores leves e quase em tempo real, adequados para limiares e acompanhamento de SLOs (ex: CPU, taxa de HTTP 5xx). Os logs capturam telemetria estruturada e consultável que suporta correlação e análise de causa raiz. Projete alertas de métrica para detecção rápida de sintomas e alertas de log para detecção mais rica e baseada em condições usando KQL.
Os grupos de ação desacoplam a detecção da resposta. Associe e-mail/SMS/voz, notificações push, webhooks seguros, conectores ITSM, Azure Functions, Logic Apps e runbooks do Automation. Use grupos de ação separados para produção e não produção, e aplique agendamentos de supressão durante manutenções planejadas. Encaminhe alertas para o gerenciamento de incidentes com payloads consistentes e inclua o contexto do recurso e links para runbooks.
As configurações de diagnóstico são obrigatórias para alcançar visibilidade completa. Habilite-as nos escopos de recurso, grupo de recursos e assinatura para exportar métricas e logs de recursos (ex: Activity, Administrative, Policy, Security, NetworkSecurityGroupFlowEvent) para o Log Analytics para consulta, para o storage para retenção a frio e para Event Hubs para streaming em SIEMs. Sempre configure uma definição de diagnóstico no nível da assinatura no Activity Log para que você possa gerar relatórios sobre implantações e avaliações de políticas e criar relatórios mensais de mudanças.
O Application Insights adiciona observabilidade profunda à aplicação. Instrumente com o SDK ou OpenTelemetry para rastreamento distribuído, dependências, requisições, exceções e eventos personalizados. Use a autoinstrumentação em App Services, Functions, AKS e VM/VMSS por meio do agente do Azure Monitor onde for suportado para minimizar alterações no código. Os testes de disponibilidade simulam o tráfego de usuários de várias regiões; configure a frequência, os locais de teste, as verificações de SSL/HTTP e os critérios de sucesso. O Smart Detection usa análises integradas para sinalizar padrões de anomalia, como picos repentinos de falhas e degradação de desempenho. A amostragem controla a ingestão e o custo, preservando a fidelidade estatística; aplique amostragem adaptativa para tráfego dinâmico ou amostragem de taxa fixa para análise determinística, e exclua transações críticas da amostragem onde a conformidade exige captura completa.
Os Azure Monitor Workbooks fornecem dashboards interativos e parametrizados que unem métricas, logs e sinais de custo em um único artefato. Use parâmetros para assinatura, região, ambiente e intervalo de tempo para permitir a reutilização entre landing zones. Combine visualizações com texto narrativo para padronizar playbooks operacionais e runbooks em uma única página. Armazene os workbooks em grupos de recursos, aplique RBAC para acesso controlado e crie templates em JSON para implantações de infraestrutura como código.
Log Analytics e KQL em Escala
Um workspace do Log Analytics é o ponto de agregação central para os Logs do Azure Monitor. Escolha um workspace regional e centralizado de acordo com os requisitos de residência de dados, ou um design federado com um por landing zone quando for necessária soberania de dados estrita ou segmentação por RBAC. Para grandes empresas, prefira um hub (workspace compartilhado) mais workspaces spoke seletivos para domínios sensíveis ou de alto volume. Alinhe os planos de tabela ao valor dos dados: use tabelas Analytics para dados de segurança e operações de alto valor; Basic Logs para logs verbosos e de baixo valor com acesso somente para pesquisa; e Archive para retenção de longo prazo e baixo custo com Search Jobs para recuperação.
As Regras de Coleta de Dados (DCRs) definem o que o Azure Monitor Agent (AMA) coleta, incluindo logs de syslog/eventos, contadores de desempenho, canais de eventos do Windows e logs de texto personalizados. Use DCRs distintas por tipo de SO e função, e gerencie o escopo via VMSS, scalesets e Azure Arc para ambientes híbridos. Prefira tabelas personalizadas baseadas em DCR em vez de APIs de ingestão legadas para governança e consistência.
A retenção deve equilibrar as janelas de investigação com o custo. Aplique retenção por tabela para dados quentes usados nas operações do dia a dia (ex: 30–90 dias) e arquive dados de cauda longa (ex: 6–24 meses) para conformidade e caça a ameaças (threat hunting). Monitore o volume de ingestão, as tabelas mais ruidosas e aplique amostragem ou filtragem nas DCRs para evitar a coleta de logs redundantes. Use níveis de compromisso para otimizar o custo de ingestão quando ele for previsível.
KQL é a língua franca operacional. Domine filtros (where), transformações (extend, project), agrupamento por tempo (bin/1m), agregações (summarize by), junções (inner/leftouter) e renderização (render timechart). Crie consultas agendadas para alertas de log com controles de limitação (throttling), dimensões split-by para alertas de alta cardinalidade e limiares dinâmicos para alertas baseados em linha de base. Visualizações materializadas e otimização de desempenho de consulta (ex: projetar e remover colunas não utilizadas no início, estreitar a janela de tempo) garantem consultas com custo-benefício. Para relatórios de implantação ARM, consulte o AzureActivity ou o histórico de alterações do Azure Resource Graph exportado para o Log Analytics e correlacione com eventos de Policy para análises de governança.
Custo, Integridade, Advisor, Resource Graph e Conformidade de Políticas
O Azure Cost Management permite uma governança proativa. Orçamentos com escopo em assinaturas, grupos de recursos ou grupos de gerenciamento disparam alertas em limites cumulativos (por exemplo, 50%, 80%, 100%). Vincule alertas de orçamento a grupos de ação para executar Logic Apps ou Functions que aplicam tags, reduzem a escala ou até mesmo colocam em quarentena recursos não críticos. Use a Análise de Custo (Cost Analysis) para criar visualizações amortizadas, agrupar por tag (centro de custo, proprietário) e identificar anomalias por serviço ou região. As recomendações de Reservation e Savings Plan revelam oportunidades de compromisso para VMs, SQL, Cosmos DB e mais. Avalie o escopo da compra (assinatura única ou compartilhada), o prazo (1 ou 3 anos) e a correspondência de cobertura (flexibilidade de tamanho de instância, Azure Hybrid Benefit).
O Azure Advisor avalia continuamente assinaturas e recursos, produzindo recomendações priorizadas em custo (dimensionamento correto, recursos ociosos, reservas), segurança (via Defender for Cloud), confiabilidade (redundância de zona, postura de backup/restauração), desempenho (escalabilidade, orientação de SKU) e excelência operacional (higiene de tags, adoção de políticas). Acompanhe o Advisor Score para quantificar a postura e direcionar os backlogs de engenharia.
O Azure Service Health operacionaliza a conscientização sobre a plataforma. Problemas de serviço (Service issues) capturam incidentes em tempo real; manutenções planejadas (planned maintenance) comunicam futuras alterações na plataforma; avisos de integridade (health advisories) incluem descontinuações e melhores práticas. Configure alertas de integridade do serviço com grupos de ação, filtrando por assinatura, região e serviço. Combine o Service Health com o Resource Health para distinguir falhas de plataforma de problemas na carga de trabalho, permitindo uma triagem de incidentes precisa.
O Azure Resource Graph fornece inventário e análise de conformidade em todo o tenant com consultas de baixa latência e em grande escala, usando uma sintaxe semelhante à KQL. Consulte milhares de assinaturas para enumerar desvios de recursos (resource drift), ativos sem tags, configurações inseguras ou SKUs não suportados. Una os resultados do Resource Graph com os recursos de conformidade do Policy para produzir totalizações (rollups) no nível do grupo de gerenciamento, incluindo exceções e o último horário de avaliação. Use o controle de alterações (change tracking), onde disponível, para capturar deltas de propriedades para análise forense.
O Azure Policy impõe barreiras de proteção (guardrails) e mede a conformidade. Atribua políticas e iniciativas nos escopos de grupo de gerenciamento, assinatura ou grupo de recursos. Entenda os estados de conformidade: em conformidade (compliant), não conforme (non-compliant), conflito (conflict), erro (error) e isento (exempt). Use isenções com justificativa e data de expiração para modelar a aceitação de risco sem distorcer as métricas de conformidade, e exclua apenas o escopo mínimo necessário. Para os efeitos deployIfNotExists e modify, configure tarefas de remediação suportadas por uma identidade gerenciada com permissões de privilégio mínimo. Monitore o status dos trabalhos de remediação, falhas e operações no painel de conformidade e no Activity Log; defina alertas para não conformidade persistente. Combine as avaliações do Policy com o Resource Graph e Workbooks para criar painéis de governança de nível executivo.
← Arquitetura de Integração e Mensageria · Todos os domínios · Migração e Modernização →
Pratique estas questões → · Prática cronometrada no ExamRoll.io →
Pass the whole exam — not just this question
You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.
Passe no seu exame →