Microsoft AZ-305: Высокая доступность, аварийное восстановление и непрерывность бизнеса — Руководство по подготовке

Часть Microsoft Azure Solutions Architect Expert AZ-305 — Руководство по подготовке. Практикуйтесь с проверенными ответами в центре экзаменов Microsoft, или пройдите тесты на время на ExamRoll.io.

Обзор

Высокая доступность (HA), аварийное восстановление (DR) и непрерывность бизнес-процессов (BC) в Azure требуют продуманного проектирования на уровнях вычислений, данных и сети. Отказоустойчивость начинается с четкого определения целевого времени восстановления (RTO) и целевой точки восстановления (RPO), а затем объединяет возможности платформы — Зоны доступности, глобальную маршрутизацию, репликацию данных, резервное копирование и оркестрацию отработки отказа — в протестированную, автоматизированную стратегию. Azure обеспечивает изоляцию сбоев на уровне зон и регионов, глобальное распределение на основе DNS и anycast, устойчивость данных в нескольких регионах и управляемое политиками резервное копирование/восстановление для достижения строгих целей при контроле затрат и операционной сложности.

Архитектура на основе RTO/RPO и отказоустойчивость на уровне зон/глобальном уровне

Проектирование начинается с RTO и RPO. RTO определяет, как быстро должен возобновиться сервис после сбоя; RPO определяет максимально допустимую потерю данных. Для достижения низкого RTO требуется автоматическая отработка отказа и предварительно выделенные мощности; для достижения низкого RPO требуется синхронная или почти синхронная репликация и частые согласованные точки восстановления.

Зоны доступности — это независимые домены сбоя в центрах обработки данных в пределах одного региона. Зональные сервисы (например, Virtual Machines, управляемые диски, общедоступные IP-адреса уровня Standard) привязаны к одной зоне. Сервисы, избыточные в пределах зоны (например, frontend’ы Azure Load Balancer Standard, избыточные между зонами, предложения хранилищ с избыточностью в пределах зоны и уровни Azure SQL с избыточностью в пределах зоны), автоматически охватывают несколько зон. Типичный отказоустойчивый паттерн предполагает развертывание зональных виртуальных машин как минимум в двух зонах, их размещение в одной виртуальной сети и предоставление доступа через frontend балансировщика нагрузки, избыточный между зонами. Это исключает сбой в одной зоне как причину простоя.

На глобальном уровне (global edge) выберите между распределением нагрузки на основе DNS и прокси-сервера с anycast-маршрутизацией:

На уровне 4 Azure Load Balancer обеспечивает распределение нагрузки TCP/UDP со сверхнизкой задержкой. Standard Load Balancer поддерживает зональные и избыточные между зонами frontend’ы, порты высокой доступности (HA ports), правила для исходящего трафика и безопасное по умолчанию поведение (явная настройка NSG и пула backend’ов). Пробы работоспособности (TCP/HTTP) определяют состояние backend’ов; в случае сбоя экземпляры удаляются из ротации. Basic Load Balancer не поддерживает зоны, не имеет расширенных функций и SLA — избегайте его использования в производственной среде. Cross-region Load Balancer добавляет глобальный anycast frontend, который распределяет нагрузку между региональными Standard Load Balancer, позволяя создавать мультирегиональные архитектуры в режиме «активный-активный» для нагрузок, отличных от HTTP, и обеспечивая быструю отработку отказа на уровне региона на основе проверок работоспособности.

Защита данных и аварийное восстановление: Azure Backup и Site Recovery

Azure Backup обеспечивает восстановление на определённый момент времени; Azure Site Recovery (ASR) предоставляет репликацию рабочих нагрузок и оркестрованный переход на другой ресурс (failover). Они решают взаимодополняющие задачи и часто используются вместе.

Варианты хранилищ Azure Backup:

Политики резервного копирования определяют, когда выполняются резервные копии, их уровни хранения (ежедневные/еженедельные/ежемесячные/ежегодные) и параметры согласованности. Обратимое удаление (soft delete) добавляет окно безопасности, в течение которого удалённые элементы резервных копий можно восстановить, что защищает от случайного или злонамеренного удаления. Восстановление между регионами (cross-region restore) позволяет выполнять восстановление из вторичного региона, когда хранилище использует геоизбыточные опции; эту функцию необходимо включить, и её доступность зависит от поддержки в регионе и готовности плоскости данных.

Azure Site Recovery реплицирует рабочие нагрузки между зонами или регионами и оркестрирует сквозное аварийное восстановление (DR):

Непрерывность на уровне данных: Azure SQL, репликация хранилища и Cosmos DB

Каждая служба данных предоставляет свои семантики долговечности и отработки отказа, которые должны соответствовать требованиям согласованности приложений.

Azure SQL Database и Azure SQL Managed Instance:

Варианты репликации Azure Storage:

Azure Cosmos DB:

Собираем все вместе: достижение конкретных целей восстановления

Сопоставьте каждый уровень с его механизмом обеспечения непрерывности, руководствуясь RTO/RPO и доменами сбоя:

Тестирование не подлежит обсуждению. Планируйте регулярные тестовые отработки отказа ASR, проводите учения по проверке работоспособности Front Door/Traffic Manager, проверяйте поведение групп отработки отказа SQL под нагрузкой и выполняйте симуляции аварийного переключения хранилища в изолированной среде (песочнице). Организуйте измерение RTO и автоматизируйте откат/возврат в исходное состояние с помощью runbooks. Документируйте и отрабатывайте операционные runbooks, чтобы дежурные специалисты могли действовать последовательно в стрессовых ситуациях.

Практический сценарий

Expedia Group необходимо модернизировать свою глобальную платформу бронирования путешествий, чтобы обеспечить RTO ≤ 15 минут и RPO ≤ 5 минут для основных операций бронирования, выдерживая при этом 10-кратные всплески трафика во время крупных туристических событий. Платформа обслуживает веб- и мобильных клиентов по всему миру со смешанными HTTP и не-HTTP рабочими нагрузками.

  1. Создание зональной отказоустойчивости в основном регионе
  1. Добавление межрегионального аварийного восстановления (DR) с активным чтением в нескольких регионах (active/active reads)
  1. Защита состояния и поддержка восстановления после повреждения данных
  1. Оркестрация аварийного восстановления (DR) и проверка RTO
  1. Глобальная маршрутизация для смешанных протоколов

Почему выбраны именно эти службы


Сетевое взаимодействие и подключение · Все домены · Архитектура безопасности и Zero Trust

Отработать эти вопросы → · Тесты на время на ExamRoll.io →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

Сдайте экзамен →

Просмотреть Microsoft →

Related guides

Все включено

Одна подписка. Каждый экзамен.

Каждый план открывает неограниченный поиск ответов, практические тесты, объяснения AI и полную библиотеку ресурсов — на более чем 20 языках.

Ежемесячно
24.87
Just €0.83/day
Все включено:
  • Неограниченный поиск ответов
  • Неограниченные практические тесты
  • Объяснения на основе AI
  • Полная библиотека ресурсов
  • 20+ языков
  • Еженедельные обновления контента
  • Награды и рефералы
  • Приоритетная поддержка
Начать бесплатную пробную версию

Кредитная карта не требуется*

Лучшая цена
12 месяцев
179.87
Just €0.49/daySave 40%
Все включено:
  • Неограниченный поиск ответов
  • Неограниченные практические тесты
  • Объяснения на основе AI
  • Полная библиотека ресурсов
  • 20+ языков
  • Еженедельные обновления контента
  • Награды и рефералы
  • Приоритетная поддержка
Начать бесплатную пробную версию

Кредитная карта не требуется*

✓ Включен бесплатный план · ✓ Отмена в любое время · ✓ Все планы открывают полный продукт