Microsoft AZ-900: Мониторинг, автоматизация и управление — Руководство по подготовке
Часть Microsoft Azure AZ-900 — Руководство по подготовке. Практикуйтесь с проверенными ответами в центре экзаменов Microsoft, или пройдите тесты на время на ExamRoll.io.
Операционное совершенство в Azure зависит от наблюдаемости платформ, воспроизводимой автоматизации и унифицированного управления в облачных и гибридных средах. Azure Monitor обеспечивает телеметрическую основу для сбора метрик, логов, трассировок и комплексной аналитики приложений. Инструменты управления — от портала Azure до CLI и PowerShell — позволяют командам действовать на основе этой аналитики в больших масштабах. Службы автоматизации, вместе с Azure Arc и Azure Lighthouse, расширяют контроль на серверы и кластеры в любом расположении и оптимизируют операции между тенантами для поставщиков услуг и централизованных IT-отделов.
Azure Monitor: метрики, логи, оповещения и Application Insights
Azure Monitor собирает два основных типа сигналов: метрики и логи. Метрики — это легковесные числовые временные ряды, оптимизированные для сценариев, близких к реальному времени, таких как дашборды и автомасштабирование. Обычно они хранятся 93 дня. Логи — это подробные записи с гибкой схемой, которые хранятся в рабочих областях Log Analytics и запрашиваются с помощью Kusto Query Language (KQL). С помощью агента Azure Monitor и правил сбора данных (Data Collection Rules, DCR) данные с виртуальных машин, серверов с поддержкой Arc и диагностические данные платформы можно направлять в одну или несколько рабочих областей в разных регионах для централизованного анализа и долгосрочного хранения. Срок хранения стандартных логов настраивается — обычно от 30 до 730 дней — с возможностью недорогого архивирования и восстановления (rehydration) для анализа исторических данных. Application Insights, построенный на базе Azure Monitor, инструментирует приложения для распределенной трассировки, отслеживания зависимостей, тестов доступности и автоматического обнаружения аномалий. Он поддерживает OpenTelemetry для сбора данных независимо от поставщика (vendor-neutral), позволяя разработчикам сопоставлять вызовы клиента, сервера и базы данных в единой карте транзакций. Live Metrics предоставляют телеметрию сервера с посекундной детализацией без выборки, в то время как адаптивная выборка (adaptive sampling) снижает затраты на сбор данных, не теряя сквозной трассировки для критических сбоев. Оповещения охватывают уровни ресурса, подписки и тенанта. Оповещения по метрикам (Metric alerts) оценивают пороговые значения временных рядов с минутным интервалом и могут автоматически настраиваться с помощью динамических порогов. Оповещения по логам (Log alerts) выполняют KQL-запросы по расписанию для обнаружения сложных паттернов между ресурсами и регионами, а оповещения по журналу действий (activity log alerts) срабатывают на события уровня управления (control-plane), такие как создание, обновление или удаление. Группы действий (Action groups) отделяют обнаружение от реагирования, запуская уведомления (email, SMS, push, голосовые) и автоматизацию (webhook/secure webhook, Logic Apps, Functions, Automation runbooks, коннекторы ITSM). Правила подавления (Suppression rules) и правила обработки оповещений (alert processing rules) помогают уменьшить информационный шум, отключая или перенаправляя оповещения во время плановых окон обслуживания. Дашборды и книги (Workbooks) представляют телеметрию по-разному. Дашборды Azure — это плиточные, межсервисные панели, идеально подходящие для быстрого операционного обзора и закрепления графиков метрик. Книги (Workbooks) — это аналитические, параметризованные и совместные документы, которые объединяют метрики, логи и визуализации с интерактивностью на основе запросов. Книги отлично подходят для операционных инструкций (runbooks), анализа после инцидентов и обзоров сервисов, где операторы могут переключаться между измерениями и углубляться в необработанные данные, не покидая контекста.
Service Health и сигналы отказоустойчивости ресурсов
Доступность и обслуживание платформы требуют специального мониторинга, выходящего за рамки метрик ресурсов. Azure Service Health предоставляет персонализированную информацию о проблемах со службами, плановом обслуживании и рекомендациях по работоспособности, затрагивающих конкретные регионы и службы в подписке. Он дополняет общедоступную страницу состояния Azure (Azure Status), предоставляя информацию о влиянии на уровне подписки, временные рамки и анализ первопричин (когда он доступен). Оповещения о работоспособности можно настроить так, чтобы они уведомляли операционные команды через группы действий в момент, когда региональный инцидент со службой влияет на развернутые рабочие нагрузки. Resource Health фокусируется на состоянии отдельных ресурсов, таких как виртуальные машины, службы приложений или базы данных. Он различает сбои, вызванные платформой, и события, инициированные пользователем, предоставляя текущие и исторические данные о состоянии работоспособности. Интеграция оповещений Service Health и Resource Health с управлением инцидентами гарантирует, что команды получают уведомления, когда первопричиной является платформа, что сокращает время на диагностику исправных компонентов приложения. Объединение этих сигналов с оповещениями Azure Monitor обеспечивает полную видимость всего стека: производительность приложения, утилизация инфраструктуры и доступность платформы в единой операционной картине.
← Управление и соответствие требованиям · Все домены · Поддержка →
Отработать эти вопросы → · Тесты на время на ExamRoll.io →
Pass the whole exam — not just this question
You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.
Сдайте экзамен →