Amazon DOP-C02: İzleme, Günlükleme ve Gözlemlenebilirlik — Çalışma kılavuzu

Şunun bir parçası: AWS DevOps Engineer Professional DOP-C02 — Çalışma kılavuzu. Doğrulanmış cevaplarla şurada pratik yapın: Amazon sınav merkezi, veya şurada süreli deneme sınavları çözün: ExamRoll.io.

Genel Bakış

AWS’te izleme, günlük kaydı ve gözlemlenebilirlik; metrikleri, günlükleri, izleri, olayları ve sağlık telemetrisini eyleme dönüştürülebilir sinyaller halinde birleştirmeyi gerektirir. Etkili mimariler; metrikler, alarmlar ve panolar için Amazon CloudWatch’ı; günlük alımı ve analizi için CloudWatch Logs ve Logs Insights’ı; dağıtık izleme için AWS X-Ray’i; denetim ve bütünlük için AWS CloudTrail’i; olay güdümlü tespit ve otomasyon için Amazon EventBridge’i; hesaba özgü hizmet olayları için AWS Health’i; ve büyük ölçekte arama ve korelasyon için merkezi işlem hatlarını (Kinesis Data Firehose ve OpenSearch) kullanır. Aşağıdaki desenler gürültünün azaltılmasını, hassas sinyal yönlendirmesini, otomasyonu ve çoklu hesap/çoklu Bölge operasyonlarını vurgular.

CloudWatch Metrikleri, Alarmları, Panoları ve Bileşik Alarmlar

CloudWatch metrikleri; SLO’lar, ölçeklendirme ve uyarılar için temel oluşturur. Sinyalleri izole etmek için (örneğin, apiOperation, appVersion, statusCode) ayrıntılı boyutlara sahip özel metrikler yayınlayın. Lambda, container’lar ve EC2’den yüksek kardinaliteli boyutları verimli bir şekilde yaymak ve PutMetricData API’sinin ek yükünden kaçınmak için yapılandırılmış günlüklerle birlikte CloudWatch Gömülü Metrik Formatını (EMF) kullanın.

Alarmları sağlam bir değerlendirme ile yapılandırın:

Bileşik alarmlar, birden çok temel alarmı AND/OR mantığıyla birleştirerek alarm yorgunluğunu azaltır. Örneğin, yalnızca p95 gecikmesi yüksek olduğunda VE 5xx oranı eşiği aştığında VE CPU doygunluğu devam ettiğinde uyarı vererek kullanıcı etkisine göre hizalanın. Bileşik alarmlar, hesaplar arası gözlemlenebilirlik veya merkezi bir hesaba metrik akışları aracılığıyla Bölgeler/hesaplar genelindeki alt alarmlardan durum güncellemelerini kabul eder.

Panolar, hizmetler genelindeki temel göstergeleri görselleştirir. Metrikler, Logs Insights sorgu sonuçları ve Alarm Durumu için widget’lar kullanın. Pano kurallarını (adlandırma, zaman aralıkları, SLO katmanları) standartlaştırın ve CloudWatch Observability Access Manager (OAM) ile Bölgeler arası/hesaplar arası görünümlerden yararlanın. Anlık korelasyon için, Logs Insights ve X-Ray ServiceLens widget’larını hizmet haritası widget’ları ve Kinesis Firehose hata oranları ile yan yana sabitleyin.

CloudWatch Logs: Günlük Grupları, Metrik Filtreleri, Abonelik Filtreleri ve Logs Insights

Günlük gruplarını uygulama/bileşen ve yaşam döngüsü aşamasına göre yapılandırın. Açık saklama politikaları belirleyin (“Never Expire” seçeneğine güvenmeyin) ve gerektiğinde KMS şifrelemesini etkinleştirin. Üreticileri ve aboneleri kontrol etmek için kaynak politikalarını ve ayrıntılı IAM’i kullanın. Yüksek verimli alım için yeterli günlük akışı eşzamanlılığını ve toplu işlemeyi sağlayın.

Metrik filtreleri, günlük desenlerini metriklere dönüştürür. Çıkarılan belirteçlerle (JSON veya boşlukla ayrılmış) bir filtre deseni tanımlayın ve belirteçleri metrik boyutlarına eşleyin. Bu, üreticileri değiştirmeden doğrudan günlüklerden yayınlanan API başına, sürüm başına, yanıt kodu başına metrikler gibi kullanım senaryolarını destekler. Birimlerin ve varsayılan değerlerin doğru olduğundan emin olun; olay başına 1’i tercih edin ve oranları metrik matematiği aracılığıyla türetin. Bu metrikleri SLO uyarısı ve panolar için kullanın.

Abonelik filtreleri, günlükleri neredeyse gerçek zamanlı olarak şuraya akıtır:

CloudWatch Logs Insights, günlükler üzerinde etkileşimli, sunucusuz sorgulama sağlar. Temel operatörler arasında zaman gruplaması için fields, filter, parse, stats, sort, limit, dedup ve bin bulunur. JSON alanlarını ayrıştırın veya metin günlükleri için grok benzeri ayrıştırma kullanın. Örnekler:

undefined

undefined

Sık kullanılan sorguları ekibin yeniden kullanımı için QueryDefinition ile kaydedin ve bunları sorgu widget’ları olarak panolara gömün. Otomasyon için, StartQuery/GetQueryResults’ı çalıştırmak ve özetleri SNS veya OpsCenter’da yayınlamak üzere EventBridge aracılığıyla bir Lambda zamanlayın. Maliyeti kontrol etmek için sorgu kapsamını belirli günlük grupları ve zaman pencereleriyle kısıtlayın.

AWS X-Ray: İzleme, Örnekleme Kuralları, Servis Haritaları ve Ek Açıklamalar

X-Ray, gecikmeye neden olan etkenleri ve hata sınırlarını bulmak için servisler arasındaki dağıtık izleri (trace) yakalar. Servisleri AWS Distro for OpenTelemetry (ADOT) veya X-Ray SDK’ları ile enstrümante edin, izleme başlığını (ör. X-Amzn-Trace-Id) yayın ve gerektiğinde (ECS/EKS/EC2) X-Ray daemon/agent’ını çalıştırın. Birçok yönetilen servis yerel olarak entegre olur (API Gateway, erişim logları aracılığıyla izleri proxy’leyen ALB, aktif izlemeli Lambda, alt segmentler aracılığıyla Step Functions).

Örnekleme kuralları, veri hacmini ve sinyal doğruluğunu kontrol eder. Aşağıdakileri içeren merkezi bir örnekleme kuralı seti kullanın:

Servis haritaları, çağrı grafiğini görselleştirerek gecikme, hata oranları ve kısıtlama (throttle) göstergeleriyle kenarları (edge) gösterir. Alt bağımlılıklar için segmentleri ve alt segmentleri incelemek üzere izlerin (trace) derinine inin. customerTier, apiOperation, appVersion veya AWS istek kimlikleri gibi yüksek kardinaliteye sahip filtreleme için ek açıklamaları (indekslenmiş anahtar-değer çiftleri) kullanın. İndeks şişmesini önlemek için ayrıntılı, indekslenmemiş bağlam için meta verileri kullanın. Logları, metrikleri ve izleri tek bir görünümde ilişkilendirmek için X-Ray izleme gruplarını CloudWatch ServiceLens ile birleştirin. Regresyonları izole etmek ve hedeflenmiş log araması için izleme kimliklerini dışa aktarmak amacıyla filtre ifadeleri (ör. annotation.appVersion = “2.3.1” and fault = true) oluşturun.

Yönetişim ve Olaylar: CloudTrail, EventBridge ve AWS Health

CloudTrail, yönetişim ve adli analiz için API etkinliğini kaydeder. Tüm hesaplar ve tüm Bölgeler (Region) genelinde bir kuruluş izi (organization trail) etkinleştirin, SSE-KMS ile merkezi bir S3 bucket’ına teslim edin, log dosyası doğrulamasını etkinleştirin ve neredeyse gerçek zamanlı tespit için CloudWatch Logs ile entegre edin. Olay sınıflarını ayırt edin:

EventBridge, tespit ve otomasyon için bir olay altyapısı (event fabric) sağlar. AWS servis olayları için varsayılan olay yolunu (event bus) kullanın ve uygulamaya özgü alan (domain) olayları için özel yollar oluşturun. source, detail-type, detail alanları, önekler, sayısal aralıklar ve “anything-but” (hariç her şey) ile eşleşen olay desenleri (event pattern) tanımlayın. Olayları yeniden şekillendirmek için girdi dönüştürücüleri (input transformer) uygulayın, hesaplar arası yayınlama için kaynak tabanlı politikalar ekleyin ve hedefler üzerinde yeniden deneme/DLQ yapılandırın. Yaygın hedefler arasında Lambda (iyileştirme), Step Functions (orkestrasyon), SQS (ayrıştırma/decoupling), Systems Manager Automation (operasyon eylemleri), CodePipeline (CI tetikleyicileri) ve SNS (bildirimler) bulunur. Tüketici (consumer) kesintilerinden kurtulmak için olayları arşivleyin ve yeniden oynatın (replay) ve güçlü tipli (strongly typed) olay modelleri oluşturmak için şema kaydını (schema registry) kullanın.

AWS Health, hesaba özgü servis olaylarını, planlanmış değişiklikleri ve operasyonel sorunları yüzeye çıkarır. Olay kanallarına yönlendirmek, OpsCenter OpsItems açmak veya bakım pencereleri için güvenli kapatma/ölçekleme eylemlerini tetiklemek amacıyla, source aws.health ve detail-type AWS Health Event ile EventBridge üzerinden entegre edin. Tüm hesaplardaki Health olaylarını birleştirmek için yetkilendirilmiş bir yönetici hesabıyla Organizasyonel Görünümü (Organizational View) kullanın ve nöbetçi (on-call) sistemlerine özel olarak hazırlanmış bildirimleri göndermek için AWS Health API’sini veya AWS Health Aware çözümünü değerlendirin.

Kinesis Data Firehose ve OpenSearch ile Merkezi Loglama

Çoklu hesap ve çoklu Bölge (multi-Region) loglama stratejisi, veri alımını (ingestion) ve aramayı standartlaştırır. Her bir üretici (producer) hesapta, CloudWatch Logs abonelik filtrelerini, merkezi bir Kinesis Data Firehose tarafından desteklenen, hesaplar arası (cross-account) bir Logs hedefine yönlendirecek şekilde yapılandırın. Firehose özelliklerini etkinleştirin:

Hızlı, düşük maliyetli sayaçlar için bu işlem hattını (pipeline) CloudWatch metrik filtreleriyle ve anlık (ad hoc) derinlemesine sorgular için Logs Insights ile birleştirin. Düzeltme (remediation) eylemlerini başlatmak veya olay (incident) kaydı oluşturmak için Firehose/OpenSearch anomalileri veya CloudWatch alarmları tarafından tetiklenen EventBridge kurallarını kullanın.

Pratik Problem Senaryosu

Airbnb, EKS ve Lambda üzerinde dağıtılmış mikroservislerde, piyasada birden fazla mobil uygulama sürümü varken, API hatalarında ve gecikmede aralıklı ani artışlar yaşıyor. Operasyon ekibinin API operasyonu, yanıt kodu ve uygulama sürümüne göre neredeyse gerçek zamanlı tespit yapmaya; izler (traces) ve loglar arasında hızlı kök neden analizine; bilinen hata kalıpları için otomatik düzeltmeye ve yönetişim düzeyinde denetim izlerine (audit trails) ihtiyacı var.

  1. Yapılandırılmış loglamayı standartlaştırın
  1. CloudWatch Logs metrik filtreleri oluşturun
  1. Katmanlı CloudWatch alarmları ve bir bileşik alarm (composite alarm) oluşturun
  1. Hedefli örnekleme (sampling) ile X-Ray izlemeyi (tracing) dağıtın
  1. ServiceLens ve Logs Insights ile korelasyon kurun

undefined

) birleştiren panolar oluşturun.

  1. Logları Firehose aracılığıyla OpenSearch ve S3’te merkezileştirin
  1. EventBridge ile tespiti ve düzeltmeyi otomatikleştirin
  1. AWS Health ve bakım yönetimi entegrasyonu yapın
  1. CloudTrail organizasyon izi (org trail) ve bütünlüğü ile yönetişimi güçlendirin
  1. Bildirimler ve Ops entegrasyonu

Bu tasarım; düşük gecikmeli, boyut açısından zengin metrikleri (CloudWatch + EMF), derinlemesine iz (trace) korelasyonunu (X-Ray + ServiceLens), ölçekte aramayı (OpenSearch + S3/Athena), olay güdümlü düzeltmeyi (EventBridge + Lambda/SSM/Step Functions) ve denetlenebilir yönetişimi (bütünlüğe sahip CloudTrail) birleştirmek için seçilmiştir. Örnekleme, saklama katmanları (retention tiers) ve gerçek kullanıcı etkisini yansıtan hedeflenmiş alarmlar ile maliyet ve doğruluğu (fidelity) dengeler.


Kod Olarak Altyapı ve Yapılandırma Yönetimi · Tüm alanlar · Güvenlik

Bu soruları çözün → · ExamRoll.io’da süreli pratik →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Sınavınızı geçin →

Amazon'a göz atın →

Related guides

Hepsi bir arada erişim

Tek abonelik. Her sınav.

Her plan, sınırsız cevap aramayı, pratik testlerini, AI açıklamalarını ve tam kaynak kütüphanesini — 20'den fazla dilde — açar.

Aylık
24.87
Just €0.83/day
Her şey dahil:
  • Sınırsız cevap arama
  • Sınırsız pratik testi
  • AI destekli açıklamalar
  • Tam kaynak kütüphanesi
  • 20+ dil
  • Haftalık içerik güncellemeleri
  • Ödüller ve yönlendirmeler
  • Öncelikli destek
Ücretsiz denemeyi başlat

Kredi kartı gerekmez*

En iyi değer
12 ay
179.87
Just €0.49/daySave 40%
Her şey dahil:
  • Sınırsız cevap arama
  • Sınırsız pratik testi
  • AI destekli açıklamalar
  • Tam kaynak kütüphanesi
  • 20+ dil
  • Haftalık içerik güncellemeleri
  • Ödüller ve yönlendirmeler
  • Öncelikli destek
Ücretsiz denemeyi başlat

Kredi kartı gerekmez*

✓ Ücretsiz plan dahil · ✓ İstediğiniz zaman iptal edin · ✓ Tüm planlar tam ürünü açar