Microsoft AZ-305: Überwachung, Kostenoptimierung und Betrieb — Lernleitfaden

Teil des Microsoft Azure Solutions Architect Expert AZ-305 — Lernleitfaden. Üben Sie mit verifizierten Antworten im Microsoft-Prüfungscenter, oder absolvieren Sie zeitlich begrenzte Übungstests auf ExamRoll.io.

Überblick

Ein robustes Design für Azure-Monitoring und -Betrieb etabliert eine einheitliche Telemetrie-Fabric, handlungsrelevante Warnungen, gesteuerte Kosten und ein flottenweites Compliance-Reporting. Die Lösung umfasst die Metriken und Protokolle von Azure Monitor, Log Analytics und die Kusto Query Language (KQL), Application Insights für die Anwendungstelemetrie sowie die operative Governance durch Azure Policy, Azure Resource Graph und Advisor. Die Kostenkontrolle wird durch Azure Cost Management gestärkt, während die Plattformzuverlässigkeit und das Bewusstsein für Änderungen auf Azure Service Health basieren. Azure Automation schließt den Kreis durch wiederholbare Fehlerbehebung und Orchestrierung von Updates. Workbooks führen Einblicke aus diesen Diensten für eine operative Transparenz zusammen.

Observability mit Azure Monitor, Application Insights und Workbooks

Azure Monitor sammelt Telemetriedaten von der Plattform und den Workloads und speichert Zeitreihenmetriken sowie Protokolldaten. Metriken sind leichtgewichtige Werte in Quasi-Echtzeit, die sich für Schwellenwerte und das Tracking von SLOs eignen (z. B. CPU, HTTP-5xx-Rate). Protokolle erfassen strukturierte, abfragbare Telemetriedaten, die Korrelationen und Ursachenanalysen unterstützen. Entwerfen Sie Metrik-Warnungen für eine schnelle Symptomerkennung und Protokoll-Warnungen für eine umfassendere, zustandsbasierte Erkennung mittels KQL.

Aktionsgruppen entkoppeln die Erkennung von der Reaktion. Verknüpfen Sie E-Mail/SMS/Sprachanrufe, Push-Benachrichtigungen, sichere Webhooks, ITSM-Konnektoren, Azure Functions, Logic Apps und Automation-Runbooks. Verwenden Sie separate Aktionsgruppen für Produktions- und Nicht-Produktionsumgebungen und wenden Sie während geplanter Wartungsarbeiten Unterdrückungszeitpläne an. Leiten Sie Warnungen mit konsistenten Payloads an das Incident-Management weiter und fügen Sie Ressourcenkontext und Runbook-Links hinzu.

Diagnoseeinstellungen sind für eine vollständige Transparenz unerlässlich. Aktivieren Sie diese auf Ressourcen-, Ressourcengruppen- und Abonnementebene, um Metriken und Ressourcenprotokolle (z. B. Activity, Administrative, Policy, Security, NetworkSecurityGroupFlowEvent) für Abfragen nach Log Analytics, zur Langzeitarchivierung in Storage und für das Streaming in SIEMs über Event Hubs zu exportieren. Konfigurieren Sie immer eine Diagnoseeinstellung auf Abonnementebene für das Activity Log, damit Sie über Deployments und Richtlinienauswertungen berichten und monatliche Änderungsberichte erstellen können.

Application Insights fügt eine tiefgehende Anwendungsbeobachtbarkeit (Observability) hinzu. Instrumentieren Sie mit dem SDK oder OpenTelemetry für Distributed Tracing, Abhängigkeiten, Anfragen, Ausnahmen und benutzerdefinierte Ereignisse. Nutzen Sie die Autoinstrumentierung auf App Services, Functions, AKS und VM/VMSS über den Azure Monitor Agent, wo dies unterstützt wird, um Codeänderungen zu minimieren. Verfügbarkeitstests simulieren Benutzerverkehr aus mehreren Regionen; konfigurieren Sie Frequenz, Teststandorte, SSL/HTTP-Prüfungen und Erfolgskriterien. Smart Detection verwendet integrierte Analysen, um Anomaliemuster wie plötzliche Ausfallspitzen und Leistungsbeeinträchtigungen zu erkennen. Sampling steuert die Erfassung und die Kosten bei gleichzeitiger Wahrung der statistischen Genauigkeit; wenden Sie adaptives Sampling für dynamischen Datenverkehr oder Sampling mit fester Rate für deterministische Analysen an und schließen Sie kritische Transaktionen vom Sampling aus, wenn die Compliance eine vollständige Erfassung erfordert.

Azure Monitor Workbooks bieten interaktive, parametrisierte Dashboards, die Metriken, Protokolle und Kostensignale in einem einzigen Artefakt vereinen. Verwenden Sie Parameter für Abonnement, Region, Umgebung und Zeitbereich, um die Wiederverwendbarkeit über Landing Zones hinweg zu ermöglichen. Kombinieren Sie Visualisierungen mit erläuterndem Text, um operative Playbooks und Runbooks-on-a-Page zu standardisieren. Speichern Sie Workbooks in Ressourcengruppen, wenden Sie RBAC für kontrollierten Zugriff an und erstellen Sie JSON-Vorlagen für Infrastructure-as-Code-Deployments.

Log Analytics und KQL im großen Maßstab

Ein Log Analytics-Arbeitsbereich ist der zentrale Aggregationspunkt für Azure Monitor Logs. Wählen Sie einen regionalen, zentralisierten Arbeitsbereich gemäß den Anforderungen an die Datenresidenz oder ein föderiertes Design mit einem Arbeitsbereich pro Landing Zone, wenn strikte Datensouveränität oder RBAC-Segmentierung erforderlich ist. Für große Unternehmen bevorzugen Sie ein Hub-Modell (gemeinsamer Arbeitsbereich) plus selektive Spoke-Arbeitsbereiche für sensible oder volumenstarke Domänen. Richten Sie Tabellenpläne am Datenwert aus: Verwenden Sie Analytics-Tabellen für hochwertige Sicherheits- und Betriebsdaten, Basic Logs für ausführliche, geringwertige Protokolle mit reinem Suchzugriff und Archive für die langfristige, kostengünstige Aufbewahrung mit Abruf über Search Jobs.

Datensammlungsregeln (DCRs) definieren, was der Azure Monitor Agent (AMA) sammelt, einschließlich Syslog/Ereignisprotokollen, Leistungsindikatoren, Windows-Ereigniskanälen und benutzerdefinierten Textprotokollen. Verwenden Sie separate DCRs pro Betriebssystemtyp und Rolle und verwalten Sie den Geltungsbereich über VMSS, Skalierungsgruppen und Azure Arc für Hybrid-Umgebungen. Bevorzugen Sie DCR-basierte benutzerdefinierte Tabellen gegenüber älteren Erfassungs-APIs, um Governance und Konsistenz zu gewährleisten.

Die Aufbewahrungsdauer muss einen Ausgleich zwischen Untersuchungszeiträumen und Kosten schaffen. Wenden Sie eine Aufbewahrungsdauer pro Tabelle für heiße Daten an, die im täglichen Betrieb verwendet werden (z. B. 30–90 Tage), und archivieren Sie Long-Tail-Daten (z. B. 6–24 Monate) für Compliance und Threat Hunting. Überwachen Sie das Erfassungsvolumen sowie die Tabellen mit dem höchsten Datenaufkommen und wenden Sie Sampling oder Filterung auf DCR-Ebene an, um die Sammlung redundanter Protokolle zu vermeiden. Nutzen Sie Verpflichtungsstufen (Commitment Tiers), um die Erfassungskosten bei vorhersagbarem Volumen zu optimieren.

KQL ist die operative Lingua Franca. Beherrschen Sie Filter (where), Transformationen (extend, project), Time-Binning (bin/1m), Aggregationen (summarize by), Joins (inner/leftouter) und das Rendering (render timechart). Erstellen Sie geplante Abfragen für Protokoll-Warnungen mit Drosselungssteuerungen, Split-by-Dimensionen für Warnungen mit hoher Kardinalität und dynamischen Schwellenwerten für Baseline-basierte Warnungen. Materialisierte Ansichten und die Optimierung der Abfrageleistung (z. B. frühzeitiges Verwerfen ungenutzter Spalten, Eingrenzung des Zeitfensters) gewährleisten kosteneffiziente Abfragen. Für das Reporting von ARM-Deployments fragen Sie AzureActivity oder den in Log Analytics exportierten Änderungsverlauf von Azure Resource Graph ab und korrelieren Sie die Daten mit Policy-Ereignissen für Governance-Analysen.

Kosten, Integrität, Advisor, Resource Graph und Richtlinienkonformität

Azure Cost Management ermöglicht eine proaktive Governance. Budgets, die auf Abonnements, Ressourcengruppen oder Verwaltungsgruppen ausgerichtet sind, lösen bei kumulativen Schwellenwerten (z. B. 50 %, 80 %, 100 %) Warnungen aus. Verknüpfen Sie Budgetwarnungen mit Aktionsgruppen, um Logic Apps oder Functions auszuführen, die nicht kritische Ressourcen mit Tags versehen, herunterskalieren oder sogar unter Quarantäne stellen. Verwenden Sie die Kostenanalyse, um amortisierte Ansichten zu erstellen, nach Tags (Kostenstelle, Besitzer) zu gruppieren und Anomalien nach Dienst oder Region zu identifizieren. Empfehlungen für Reservierungen und Sparpläne zeigen Einsparmöglichkeiten für VMs, SQL, Cosmos DB und mehr auf. Bewerten Sie den Kaufumfang (einzelnes Abonnement oder gemeinsam genutzt), die Laufzeit (1 oder 3 Jahre) und die Abdeckungsübereinstimmung (Flexibilität bei der Instanzgröße, Azure Hybrid Benefit).

Azure Advisor bewertet kontinuierlich Abonnements und Ressourcen und erstellt priorisierte Empfehlungen in den Bereichen Kosten (richtige Dimensionierung, ungenutzte Ressourcen, Reservierungen), Sicherheit (über Defender for Cloud), Zuverlässigkeit (Zonenredundanz, Backup/Restore-Status), Leistung (Skalierung, SKU-Anleitung) und Operational Excellence (Tag-Hygiene, Richtlinienübernahme). Verfolgen Sie den Advisor Score, um den Zustand zu quantifizieren und Engineering-Backlogs zu steuern.

Azure Service Health operationalisiert das Bewusstsein für den Plattformzustand. Dienstprobleme erfassen Live-Vorfälle; geplante Wartungsarbeiten kommunizieren bevorstehende Plattformänderungen; Integritätsratgeber enthalten Abkündigungen und Best Practices. Konfigurieren Sie Dienstintegritätswarnungen mit Aktionsgruppen und filtern Sie nach Abonnement, Region und Dienst. Kombinieren Sie Service Health mit Resource Health, um Plattformfehler von Workload-Problemen zu unterscheiden und eine genaue Triage von Vorfällen zu ermöglichen.

Azure Resource Graph liefert mandantenweite Bestands- und Konformitätsanalysen mit Abfragen mit geringer Latenz und hoher Skalierbarkeit unter Verwendung einer KQL-ähnlichen Syntax. Führen Sie Abfragen über Tausende von Abonnements aus, um Ressourcenabweichungen, nicht getaggte Assets, unsichere Konfigurationen oder nicht unterstützte SKUs aufzuzählen. Verknüpfen Sie die Ergebnisse von Resource Graph mit Richtlinienkonformitätsressourcen, um Rollups auf Verwaltungsgruppenebene zu erstellen, einschließlich Ausnahmen und dem Zeitpunkt der letzten Auswertung. Verwenden Sie die Änderungsnachverfolgung (sofern verfügbar), um Eigenschafts-Deltas für die forensische Analyse zu erfassen.

Azure Policy erzwingt Leitplanken und misst die Konformität. Weisen Sie Richtlinien und Initiativen auf den Ebenen von Verwaltungsgruppen, Abonnements oder Ressourcengruppen zu. Verstehen Sie die Konformitätszustände: konform, nicht konform, Konflikt, Fehler und ausgenommen. Verwenden Sie Ausnahmen mit Begründung und Ablaufdatum, um die Risikoakzeptanz zu modellieren, ohne die Konformitätsmetriken zu verzerren, und schließen Sie nur den minimal notwendigen Bereich aus. Konfigurieren Sie für deployIfNotExists- und modify-Effekte Wartungsaufgaben, die durch eine verwaltete Identität mit den geringsten Berechtigungen unterstützt werden. Überwachen Sie den Status von Wartungsaufträgen, Fehlern und Vorgängen im Konformitäts-Dashboard und im Activity Log; richten Sie Warnungen für andauernde Nichtkonformität ein. Kombinieren Sie Richtlinienauswertungen mit Resource Graph und Workbooks, um Governance-Dashboards für die Führungsebene bereitzustellen.

Automatisierung und Patch-Management

Azure Automation orchestriert wiederholbare Aufgaben. Erstellen Sie Runbooks in PowerShell oder Python, die durch Zeitpläne, Webhooks, ereignisbasierte Trigger oder Warnungen ausgelöst werden. Verwenden Sie Hybrid Runbook Workers, um Automatisierungen in der Nähe von Ressourcen in privaten Netzwerken oder anderen Clouds auszuführen, gesteuert durch Azure Arc. Implementieren Sie standardisierte Module und Fehlerbehandlung und speichern Sie Geheimnisse in Key Vault.

Update Management stellt die Aktualität des Betriebssystems sicher. Organisationen können Azure Automation Update Management (Legacy) oder Azure Update Manager für die Patch-Orchestrierung im großen Maßstab mit Bewertung, Genehmigung, Wartungsfenstern und dynamischen Gruppen verwenden. Integrieren Sie Warnungen, um fehlgeschlagene Bereitstellungen zu erkennen, und erstellen Sie Compliance-Berichte nach Abonnement, Betriebssystem und Schweregrad. Bei Konfigurationsdrift wendet Azure Automation State Configuration (DSC) deklarative Konfigurationen an, verfolgt die Compliance und behebt Abweichungen. Modellieren Sie Konfigurationen als Code, versionieren Sie sie und stellen Sie sie über Umgebungen hinweg bereit.

Integrieren Sie Warnungen, um Runbooks für Szenarien der automatischen Problembehebung auszulösen: Aufskalieren bei CPU-Sättigung, Neustart ausgefallener Dienste bei Verlust des Heartbeats oder das Unter-Quarantäne-Stellen nicht konformer Ressourcen, die von Policy erkannt wurden. Schließen Sie den Kreis durch die Erstellung von Incidents über ITSM-Connectors und fügen Sie Nachweise vor und nach der Problembehebung durch in Runbooks eingebettete Log Analytics-Abfragen hinzu.

Praktisches Problemszenario

Tailwind Traders betreibt eine E-Commerce-Plattform über mehrere Regionen auf AKS, App Service und Azure SQL Database in sechs Abonnements. Die Führungsebene fordert eine Serviceverfügbarkeit von 99,9 %, eine monatliche Berichterstattung über Bereitstellungsänderungen, eine Kostenreduzierung von 20 % durch Zusagen (Commitments) und eine auditierbare Einhaltung von Tagging- und Netzwerkrichtlinien.

  1. Zentralisierte Telemetrie einrichten
  1. Anwendungen instrumentieren
  1. Umsetzbare Warnmeldungen
  1. Verfügbarkeit und Benutzererfahrung
  1. Betriebs-Dashboards
  1. Kosten-Governance
  1. Advisor und Service Health
  1. Compliance und Flotten-Reporting
  1. Berichterstattung über Bereitstellungsänderungen
  1. Automatisierte Problembehebung und Patching

Jeder ausgewählte Dienst minimiert die kundenspezifische Entwicklung, skaliert über Abonnements hinweg und steht im Einklang mit den Zielen für Governance, Kosten und Zuverlässigkeit, während klare betriebliche Zuständigkeiten erhalten bleiben.


Integrations- und Messaging-Architektur · Alle Domänen · Migration und Modernisierung

Diese Fragen üben → · Zeitlich begrenzte Übung auf ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Bestehe deine Prüfung →

Microsoft durchsuchen →

Related guides

All-in-One Zugang

Ein Abonnement. Jede Prüfung.

Jeder Plan schaltet unbegrenzte Antwortsuche, Übungstests, KI-Erklärungen und die vollständige Ressourcenbibliothek frei – in über 20 Sprachen.

Monatlich
24.87
Just €0.83/day
Alles inklusive:
  • Unbegrenzte Antwortsuche
  • Unbegrenzte Übungstests
  • KI-gestützte Erklärungen
  • Vollständige Ressourcenbibliothek
  • Über 20 Sprachen
  • Wöchentliche Inhaltsaktualisierungen
  • Belohnungen & Empfehlungen
  • Priorisierter Support
Kostenlose Testphase starten

Keine Kreditkarte erforderlich*

Bestes Preis-Leistungs-Verhältnis
12 Monate
179.87
Just €0.49/daySave 40%
Alles inklusive:
  • Unbegrenzte Antwortsuche
  • Unbegrenzte Übungstests
  • KI-gestützte Erklärungen
  • Vollständige Ressourcenbibliothek
  • Über 20 Sprachen
  • Wöchentliche Inhaltsaktualisierungen
  • Belohnungen & Empfehlungen
  • Priorisierter Support
Kostenlose Testphase starten

Keine Kreditkarte erforderlich*

✓ Kostenloser Plan enthalten · ✓ Jederzeit kündbar · ✓ Alle Pläne schalten das vollständige Produkt frei