Microsoft AZ-104: Azure Monitor, резервное копирование и Site Recovery — Руководство по подготовке
Часть Microsoft Azure Administrator Associate AZ-104 — Руководство по подготовке. Практикуйтесь с проверенными ответами в центре экзаменов Microsoft, или пройдите тесты на время на ExamRoll.io.
Обзор
Операционное совершенство в Azure требует совместной работы трех компонентов: наблюдаемой телеметрии, восстанавливаемых данных и отказоустойчивых планов обеспечения непрерывности. Azure Monitor и его основа, Log Analytics, собирают высокоточные метрики и журналы, обеспечивают интеллектуальные оповещения и отображают производительность приложений. Azure Backup защищает данные платформы и IaaS с помощью управляемого политиками восстановления из хранилища, включая возможности мгновенного восстановления для минимизации времени простоя. Azure Site Recovery (ASR) реплицирует рабочие нагрузки на альтернативные площадки и организует аварийное переключение и восстановление для соответствия бизнес-требованиям RPO/RTO. Дополнительные сервисы — Network Watcher для диагностики сети и Azure Service Health для информирования о состоянии платформы — дополняют полный набор инструментов администратора.
Azure Monitor и Log Analytics
Azure Monitor объединяет метрики и журналы платформы. Метрики — это числовые временные ряды, оптимизированные для анализа в почти реальном времени (высокая кардинальность, многомерность, минутная гранулярность для большинства ресурсов). Используйте Metrics Explorer для визуализации и оповещений по метрикам в почти реальном времени со статическими или динамическими порогами. Журналы — это записи с богатой схемой, хранящиеся в рабочей области Log Analytics, запрашиваемые с помощью Kusto Query Language (KQL) для расследований, панелей мониторинга и запланированных оповещений (по журналам).
Параметры диагностики — это мост между ресурсами и приемниками телеметрии. На каждом ресурсе Azure настройте параметры диагностики, чтобы выбрать категории (метрики платформы, журналы платформы и журналы ресурсов) и направить их в одно или несколько мест назначения:
- Рабочая область Log Analytics для аналитики и оповещений на основе журналов
- Учетные записи хранения для долгосрочного, недорогого хранения и соответствия требованиям
- Центры событий (Event Hubs) для потоковой передачи в SIEM или сторонние инструменты
Проектируйте рабочие области Log Analytics осознанно:
- Область действия и доступ к рабочей области: Используйте RBAC на уровне рабочей области и таблицы для соответствия принципу наименьших привилегий и операционным границам (например, для каждой среды и региона). Запросы в контексте ресурса позволяют командам запрашивать журналы в пределах тех ресурсов, к которым у них есть доступ, даже если журналы централизованы.
- Сбор данных: Отдавайте предпочтение агенту Azure Monitor (AMA) с правилами сбора данных (DCRs) перед устаревшими агентами. DCRs определяют, что собирать (счетчики производительности, журналы событий Windows/Linux, syslog, пользовательские текстовые журналы), с каких машин и в какие таблицы, обеспечивая гранулярные конвейеры для каждой области.
- Стоимость и хранение: Контролируйте затраты с помощью хранения для каждой таблицы, архивации и базовых журналов (basic logs), где это уместно. По возможности используйте выборку и фильтрацию во время сбора данных.
- Источники данных: Azure Activity Log, журналы ресурсов через параметры диагностики, VM insights и Container insights, журналы входа и аудита Azure AD (через параметры диагностики), журналы потоков Azure Firewall/NSG, пользовательские журналы приложений и данные из локальной среды через агент Azure Monitor.
Владение KQL имеет решающее значение. Примеры:
- Быстрый аудит: AzureActivity | where OperationName startswith “Create” and ActivityStatus == “Succeeded” | summarize count() by Caller
- Анализ производительности: Perf | where ObjectName == “LogicalDisk” and CounterName == “% Free Space” | summarize min(CounterValue) by Computer, InstanceName
- Частота ошибок: AppTraces | where SeverityLevel >= 3 | summarize Errors=count() by bin(TimeGenerated, 5m)
Группы действий (Action groups) определяют, кто и что реагирует на оповещения: email/SMS/push/голосовые вызовы, защищенные веб-перехватчики, коннекторы ITSM, Functions, Logic Apps и runbooks службы Automation. Повторно используйте группы действий в разных правилах оповещений и обеспечивайте согласованную маршрутизацию инцидентов.
Azure Monitor поддерживает несколько типов оповещений:
- Оповещения по метрикам: Оценивают метрики платформы или пользовательские метрики почти в реальном времени со статическими порогами или динамическими порогами, которые изучают нормальные базовые показатели.
- Оповещения по журналам (запланированным запросам): Выполняют KQL-запросы к данным рабочей области с настроенной частотой; срабатывают по количеству результатов или числовому агрегату. Полезны для сложных шаблонов, охватывающих несколько ресурсов.
- Оповещения по журналу действий: Срабатывают на события уровня управления (например, при удалении ВМ или изменении назначения роли). Для них не требуется рабочая область.
- Интеллектуальное обнаружение (Smart detection): Обнаружение аномалий и всплесков частоты сбоев, в основном для ресурсов Application Insights; автоматически уведомляет владельцев и может интегрироваться с группами действий.
Application Insights и оповещения
Application Insights инструментирует код и платформу для предоставления сквозной телеметрии приложений. Используйте строки подключения и первоклассные SDK (.NET, Java, Node.js, Python) или OpenTelemetry для независимой от поставщика трассировки. Для PaaS-сервисов (App Service, Functions, AKS) включайте авто-инструментацию, где это возможно, для сбора запросов, зависимостей, исключений и трассировок без изменения кода. Поддерживайте контекст распределенной трассировки для корреляции переходов между клиентом, API и бэкендом.
Ключевые типы телеметрии:
- Запросы (Requests): Входящие операции с кодами ответа и длительностью
- Зависимости (Dependencies): Исходящие вызовы (HTTP, SQL, очереди) с длительностью и признаком успеха
- Исключения и трассировки (Exceptions and Traces): Ошибки и диагностические журналы с уровнем серьезности
- Метрики (Metrics): Пользовательские или стандартные счетчики
- Просмотры страниц и тайминги браузера (Page views and browser timings): Производительность фронтенда
- Пользовательские события и измерения (Custom events and measurements): Сигналы, специфичные для домена
Применяйте адаптивную выборку для контроля объема принимаемых данных без потери точности сигнала и используйте Live Metrics Stream для получения информации с низкой задержкой во время инцидентов.
Тесты доступности проверяют внешнюю достижимость и SLA:
- Стандартные тесты (проверка URL): Опрашивают конечные точки из нескольких регионов Azure, проверяют коды состояния, сроки действия SSL-сертификатов, совпадение содержимого и пороговые значения времени ответа.
- Пользовательские тесты: Используйте TrackAvailability в коде для синтетических рабочих процессов или защищенных конечных точек. Сбои могут автоматически генерировать оповещения, связанные с группами действий.
Дополните систему оповещений интеллектуальным обнаружением (smart detection) в Application Insights для:
- Аномалии сбоев и снижение производительности
- Утечки памяти и аномалии зависимостей Эти функции изучают типичные шаблоны и сокращают количество ложных срабатываний, дополняя оповещения на основе пороговых значений.
Azure Backup
Хранилище Recovery Services является центральным элементом для управления резервным копированием, политиками и восстановлением. Размещайте хранилища в том же регионе, что и защищаемые ресурсы (или в парном регионе для сценариев межрегионального восстановления, поддерживаемых службой). Защитите хранилища с помощью обратимого удаления, защиты от очистки и многопользовательской авторизации для критически важных операций.
Политики резервного копирования определяют расписания и сроки хранения:
- Резервное копирование Azure VM: ежедневные моментальные снимки с краткосрочным хранением, опциональное еженедельное/ежемесячное/ежегодное долгосрочное хранение; точки восстановления, согласованные с приложениями, с помощью VSS (Windows) или скриптов pre/post (Linux), если эта функция включена.
- Резервное копирование Azure Files: ежедневные резервные копии на основе моментальных снимков общих файловых ресурсов; срок хранения в соответствии с бизнес-требованиями; поддерживает восстановление в исходный или альтернативный общий ресурс с восстановлением на уровне отдельных элементов.
- SQL Server в ВМ Azure: полные (ежедневно/еженедельно), разностные (ежедневно) и резервные копии журналов (с частотой до 15 минут) обеспечивают восстановление на определенный момент времени. Функция Auto-protect обнаруживает новые базы данных.
Функция Instant Restore ускоряет восстановление ВМ, используя локально хранящиеся моментальные снимки, которые хранятся в течение короткого периода времени перед переносом в долгосрочное хранилище в vault. Администраторы могут:
- Восстановить всю ВМ (новый вычислительный ресурс), чтобы минимизировать время восстановления.
- Восстановить диски и подключить их к существующей ВМ для целенаправленного исправления.
- Выполнить восстановление файлов и папок, смонтировав точку восстановления как временное устройство iSCSI к любой ВМ в подписке (при наличии разрешений роли), что позволяет выполнять точечное восстановление после таких инцидентов, как атаки программ-вымогателей.
При резервном копировании ВМ следует учитывать возможность исключения дисков с некритичными данными, обработку шифрования (Azure Backup поддерживает зашифрованные диски) и модели согласованности (согласованность на уровне сбоя и согласованность на уровне приложений). Резервное копирование Azure Files использует моментальные снимки хранилища, что дает преимущества инкрементного, экономящего пространство хранения и защиты с помощью обратимого удаления. Резервное копирование SQL в ВМ Azure использует расширение, осведомленное о рабочей нагрузке, которое координируется хранилищем для создания согласованных, восстанавливаемых цепочек резервных копий для групп доступности Always On и автономных экземпляров.
← Базы данных Azure и службы данных · Все домены · Безопасность Azure и соответствие требованиям →
Отработать эти вопросы → · Тесты на время на ExamRoll.io →
Pass the whole exam — not just this question
You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.
Сдайте экзамен →