Amazon DOP-C02: Monitoring, Logging en Observeerbaarheid — Studiegids

Onderdeel van de AWS DevOps Engineer Professional DOP-C02 — Studiegids. Oefen met geverifieerde antwoorden in het Amazon-examencentrum, of doe getimede oefentests op ExamRoll.io.

Overzicht

Monitoring, logging en observability op AWS vereisen het combineren van metrics, logs, traces, events en health-telemetrie tot bruikbare signalen. Effectieve architecturen gebruiken Amazon CloudWatch voor metrics, alarmen en dashboards; CloudWatch Logs en Logs Insights voor log-ingestion en -analyse; AWS X-Ray voor distributed tracing; AWS CloudTrail voor auditing en integriteit; Amazon EventBridge voor event-driven detectie en automatisering; AWS Health voor accountspecifieke service-events; en gecentraliseerde pipelines (Kinesis Data Firehose en OpenSearch) voor zoeken en correlatie op grote schaal. De onderstaande patronen leggen de nadruk op ruisonderdrukking, precieze signaalroutering, automatisering en multi-account/multi-Region-operaties.

CloudWatch Metrics, Alarms, Dashboards en Composite Alarms

CloudWatch-metrics vormen de basis voor SLO’s, schaalvergroting en alarmering. Publiceer custom metrics met fijngranulaire dimensies om signalen te isoleren (bijvoorbeeld apiOperation, appVersion, statusCode). Gebruik het CloudWatch Embedded Metric Format (EMF) met gestructureerde logs om high-cardinality-dimensies efficiënt uit te zenden vanuit Lambda, containers en EC2, en vermijd zo de overhead van de PutMetricData API.

Configureer alarmen met een robuuste evaluatie:

Composite alarms verminderen alarmmoeheid door meerdere onderliggende alarmen te combineren met AND/OR-logica. Alarmeer bijvoorbeeld alleen wanneer de p95-latency hoog is EN de 5xx-rate een drempelwaarde overschrijdt EN de CPU-verzadiging aanhoudt, om zo aan te sluiten bij de impact op de gebruiker. Composite alarms accepteren statusupdates van onderliggende alarmen over Regions/accounts heen via cross-account observability of metric streams naar een centraal account.

Dashboards visualiseren de belangrijkste indicatoren over verschillende services heen. Gebruik widgets voor metrics, Logs Insights-queryresultaten en alarmstatussen. Standaardiseer dashboardconventies (naamgeving, tijdsbestekken, SLO-overlays) en maak gebruik van cross-Region/cross-account-weergaven met CloudWatch Observability Access Manager (OAM). Voor ad-hoccorrelatie, pin Logs Insights- en X-Ray ServiceLens-widgets naast service map-widgets en Kinesis Firehose-foutpercentages.

CloudWatch Logs: Log Groups, Metric Filters, Subscription Filters en Logs Insights

Structureer loggroepen per applicatie/component en levenscyclusfase. Stel expliciet retentiebeleid in (vertrouw niet op ‘Never Expire’) en schakel KMS-encryptie in waar nodig. Gebruik resource policies en fijngranulaire IAM om producenten en abonnees te beheren. Zorg voor voldoende concurrency van logstreams en batching voor ingestion met hoge doorvoersnelheid.

Metric filters zetten logpatronen om in metrics. Definieer een filterpatroon met geëxtraheerde tokens (JSON of door spaties gescheiden) en map de tokens naar metric-dimensies. Dit ondersteunt use cases zoals per-API, per-versie, per-response-code metrics die rechtstreeks vanuit logs worden gepubliceerd zonder de producenten aan te passen. Zorg ervoor dat eenheden en standaardwaarden correct zijn; geef de voorkeur aan 1 per event en leid ratio’s af via metric math. Gebruik deze metrics voor SLO-alarmering en dashboards.

Subscription filters streamen logs bijna real-time naar:

CloudWatch Logs Insights biedt een interactieve, serverless query-mogelijkheid over logs. Kernoperatoren zijn onder andere fields, filter, parse, stats, sort, limit, dedup en bin voor time bucketing. Parse JSON-velden of gebruik grok-achtige parsing voor tekstlogs. Voorbeelden:

AWS X-Ray: Tracing, Samplingregels, Service Maps en Annotaties

X-Ray legt gedistribueerde traces vast over services heen om de oorzaken van latency en foutgrenzen te vinden. Instrumenteer services met de AWS Distro for OpenTelemetry (ADOT) of X-Ray SDK’s, propageer de trace-header (bijv. X-Amzn-Trace-Id) en draai de X-Ray-daemon/agent waar nodig (ECS/EKS/EC2). Veel managed services integreren native (API Gateway, ALB via access logs die traces doorsturen, Lambda met actieve tracing, Step Functions via subsegmenten).

Samplingregels beheren het datavolume en de signaalgetrouwheid. Gebruik een centrale set samplingregels met:

Service maps visualiseren de call graph en tonen edges met latency, foutpercentages en throttle-indicatoren. Zoom in op traces om segmenten en subsegmenten te onderzoeken op downstream-afhankelijkheden. Gebruik annotaties (geïndexeerde key-value-paren) voor filtering met hoge cardinaliteit, zoals customerTier, apiOperation, appVersion of AWS request-ID’s. Gebruik metadata voor uitgebreide, niet-geïndexeerde context om ‘index blowout’ te voorkomen. Combineer X-Ray trace groups met CloudWatch ServiceLens om logs, metrics en traces in één overzicht te correleren. Maak filterexpressies (bijv. annotation.appVersion = “2.3.1” and fault = true) om regressies te isoleren en trace-ID’s te exporteren voor gericht zoeken in logs.

Governance en Events: CloudTrail, EventBridge en AWS Health

CloudTrail legt API-activiteit vast voor governance en forensische analyse. Activeer een organization trail voor alle accounts en alle Regions, lever deze af in een gecentraliseerde S3-bucket met SSE-KMS, activeer logbestandsvalidatie en integreer met CloudWatch Logs voor bijna-realtime detectie. Maak onderscheid tussen eventklassen:

EventBridge biedt een ’event fabric’ voor detectie en automatisering. Gebruik de default event bus voor events van AWS-services en maak custom bussen voor events van het applicatiedomein. Definieer event patterns die matchen op source, detail-type, detail-velden, prefixes, numerieke bereiken en ‘anything-but’. Pas input transformers toe om events te hervormen, koppel resource-based policies voor cross-account publicatie en configureer retry/DLQ op targets. Veelvoorkomende targets zijn onder andere Lambda (herstelacties), Step Functions (orkestratie), SQS (ontkoppeling), Systems Manager Automation (ops-acties), CodePipeline (CI-triggers) en SNS (notificaties). Archiveer en herhaal events om te herstellen van storingen bij consumers, en gebruik de schema registry om sterk getypeerde eventmodellen te genereren.

AWS Health maakt accountspecifieke service-events, geplande wijzigingen en operationele problemen zichtbaar. Integreer via EventBridge met source aws.health en detail-type AWS Health Event om events door te sturen naar incidentkanalen, OpsCenter OpsItems te openen, of veilige shutdown/scale-acties te triggeren voor onderhoudsvensters. Gebruik de Organizational View met een delegated admin-account om Health-events van alle accounts te aggregeren, en overweeg de AWS Health API of de AWS Health Aware-oplossing om samengestelde notificaties naar on-call-systemen te pushen.

Gecentraliseerde logging met Kinesis Data Firehose en OpenSearch

Een loggingstrategie voor meerdere accounts en regio’s standaardiseert de opname en het doorzoeken van gegevens. Configureer in elk producer-account CloudWatch Logs-abonnementsfilters naar een cross-account Logs-bestemming die wordt ondersteund door een centrale Kinesis Data Firehose. Schakel Firehose-functies in:

Combineer deze pipeline met CloudWatch-metriekfilters voor snelle, goedkope tellers en met Logs Insights voor ad-hoc diepgaande query’s. Gebruik EventBridge-regels die worden geactiveerd door afwijkingen in Firehose/OpenSearch of CloudWatch-alarmen om herstelacties te starten of incidenten aan te maken.

Praktisch probleemscenario

Airbnb ervaart periodieke pieken in API-fouten en -latentie in microservices die op EKS en Lambda zijn geïmplementeerd, met meerdere versies van mobiele apps in omloop. De operations-afdeling heeft behoefte aan bijna-realtime detectie per API-operatie, responscode en app-versie; snelle root cause analysis over traces en logs; geautomatiseerd herstel voor bekende foutpatronen; en audit trails die voldoen aan governance-eisen.

  1. Standaardiseer gestructureerde logging
  1. Maak CloudWatch Logs-metriekfilters aan
  1. Bouw gelaagde CloudWatch-alarmen en een samengesteld alarm
  1. Implementeer X-Ray tracing met gerichte sampling
  1. Correleer met ServiceLens en Logs Insights
  1. Centraliseer logs via Firehose naar OpenSearch en S3
  1. Automatiseer detectie en herstel met EventBridge
  1. Integreer AWS Health en afhandeling van onderhoud
  1. Versterk governance met een CloudTrail org trail en integriteitscontrole
  1. Notificaties en Ops-integratie

Dit ontwerp is gekozen om metrieken met lage latentie en rijke dimensies (CloudWatch + EMF) te combineren met diepgaande trace-correlatie (X-Ray + ServiceLens), zoekopdrachten op grote schaal (OpenSearch + S3/Athena), event-driven herstel (EventBridge + Lambda/SSM/Step Functions) en auditeerbare governance (CloudTrail met integriteitscontrole). Het balanceert kosten en nauwkeurigheid met sampling, retentielagen en gerichte alarmen die de daadwerkelijke impact op de gebruiker weerspiegelen.


Infrastructuur als Code en Configuratiebeheer · Alle domeinen · Beveiliging

Oefen deze vragen → · Getimede oefening op ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Slaag voor je examen →

Blader door Amazon →

Related guides

Alles-in-één toegang

Eén abonnement. Elk examen.

Elk plan ontgrendelt onbeperkt zoeken naar antwoorden, oefentests, AI-uitleg en de volledige bronnenbibliotheek — in meer dan 20 talen.

Maandelijks
24.87
Just €0.83/day
Alles inbegrepen:
  • Onbeperkt zoeken naar antwoorden
  • Onbeperkte oefentests
  • AI-gestuurde uitleg
  • Volledige bronnenbibliotheek
  • 20+ talen
  • Wekelijkse contentupdates
  • Beloningen & verwijzingen
  • Prioriteitsondersteuning
Start gratis proefperiode

Geen creditcard vereist*

Beste waarde
12 maanden
179.87
Just €0.49/daySave 40%
Alles inbegrepen:
  • Onbeperkt zoeken naar antwoorden
  • Onbeperkte oefentests
  • AI-gestuurde uitleg
  • Volledige bronnenbibliotheek
  • 20+ talen
  • Wekelijkse contentupdates
  • Beloningen & verwijzingen
  • Prioriteitsondersteuning
Start gratis proefperiode

Geen creditcard vereist*

✓ Gratis plan inbegrepen · ✓ Annuleer op elk moment · ✓ Alle plannen ontgrendelen het volledige product