Microsoft AZ-900: 모니터링, 자동화 및 관리 — 학습 가이드
다음의 일부입니다: Microsoft Azure AZ-900 — 학습 가이드. 검증된 답안으로 연습하기: Microsoft 시험 허브, 또는 다음에서 시간 제한 모의고사 풀기: ExamRoll.io.
Azure의 운영 우수성은 관찰 가능한 플랫폼, 반복 가능한 자동화, 클라우드 및 하이브리드 환경 전반의 통합 거버넌스에 달려 있습니다. Azure Monitor는 메트릭, 로그, 추적, 엔드투엔드 애플리케이션 인사이트를 위한 원격 분석 백본을 제공합니다. Azure portal부터 CLI 및 PowerShell에 이르는 관리 도구를 통해 팀은 이러한 인사이트를 기반으로 대규모로 조치를 취할 수 있습니다. 자동화 서비스는 Azure Arc 및 Azure Lighthouse와 함께 어디서든 서버와 클러스터로 제어를 확장하고, 서비스 공급자 및 중앙 IT를 위한 테넌트 간 운영을 간소화합니다.
Azure Monitor: 메트릭, 로그, 경고 및 애플리케이션 인사이트
Azure Monitor는 메트릭과 로그라는 두 가지 기본 신호 유형을 수집합니다. 메트릭은 대시보드 및 자동 크기 조정과 같은 거의 실시간에 가까운 시나리오에 최적화된 경량 숫자 시계열이며, 일반적으로 93일 동안 보존됩니다. 로그는 Log Analytics 작업 영역에 저장되고 Kusto 쿼리 언어(KQL)로 쿼리되는, 스키마가 유연한 풍부한 레코드입니다. Azure Monitor 에이전트 및 데이터 수집 규칙(DCR)을 사용하면 VM, Arc 지원 서버, 플랫폼 진단의 데이터를 여러 지역에 걸쳐 하나 이상의 작업 영역으로 라우팅하여 중앙 집중식 분석 및 장기 보존을 수행할 수 있습니다. 표준 로그의 보존 기간은 구성 가능하며(일반적으로 30~730일), 기록 조사를 위해 저비용 보관 및 재활성화가 가능합니다. Azure Monitor를 기반으로 구축된 Application Insights는 분산 추적, 종속성 추적, 가용성 테스트, 자동 변칙 탐지를 위해 애플리케이션을 계측합니다. 공급업체에 종속되지 않는 수집을 위해 OpenTelemetry를 지원하므로 개발자는 클라이언트, 서버, 데이터베이스 호출을 단일 트랜잭션 맵으로 연관시킬 수 있습니다. 라이브 메트릭은 샘플링 없이 초 단위 서버 원격 분석을 제공하는 반면, 적응 샘플링은 중요한 오류에 대한 엔드투엔드 추적성을 잃지 않으면서 수집 비용을 절감합니다. 경고는 리소스, 구독, 테넌트 범위를 포괄합니다. 메트릭 경고는 1분 단위로 시계열 임계값을 평가하며 동적 임계값을 통해 자동 조정할 수 있습니다. 로그 경고는 예약된 KQL 쿼리를 실행하여 리소스 및 지역 전반의 복잡한 패턴을 감지하는 반면, 활동 로그 경고는 만들기, 업데이트 또는 삭제와 같은 컨트롤 플레인 이벤트 시 발생합니다. 작업 그룹은 탐지와 대응을 분리하여 알림(이메일, SMS, 푸시, 음성)과 자동화(웹후크/보안 웹후크, Logic Apps, Functions, Automation Runbook, ITSM 커넥터)를 트리거합니다. 비표시 규칙 및 경고 처리 규칙은 계획된 유지 관리 기간 동안 경고를 음소거하거나 라우팅하여 노이즈를 줄이는 데 도움이 됩니다. 대시보드와 통합 문서는 원격 분석을 다르게 표시합니다. Azure 대시보드는 빠른 운영 뷰와 메트릭 차트 고정에 이상적인 타일 기반의 교차 서비스 캔버스입니다. 통합 문서는 분석적이고 매개 변수화되었으며 협업이 가능하며, 메트릭, 로그, 시각화를 쿼리 기반 상호 작용과 혼합합니다. 통합 문서는 운영자가 컨텍스트를 벗어나지 않고 차원 간에 피벗하고 원시 데이터를 드릴다운하는 운영 Runbook, 인시던트 후 분석, 서비스 검토에 탁월합니다.
Service Health 및 리소스 복원력 신호
플랫폼 가용성 및 유지 관리에는 리소스 메트릭을 넘어서는 전용 모니터링이 필요합니다. Azure Service Health는 구독의 특정 지역 및 서비스에 영향을 미치는 서비스 문제, 계획된 유지 관리, 상태 권고에 대한 개인화된 가시성을 제공합니다. 이것은 구독 범위의 영향, 타임라인, 사용 가능한 경우 근본 원인 분석을 제공하여 공개 Azure 상태 페이지를 보완합니다. 상태 경고를 구성하여 지역 서비스 인시던트가 배포된 워크로드에 영향을 미치는 순간 작업 그룹을 통해 운영팀에 알릴 수 있습니다. Resource Health는 가상 머신, 앱 서비스 또는 데이터베이스와 같은 개별 리소스의 상태에 중점을 둡니다. 플랫폼으로 인한 중단과 사용자가 시작한 이벤트를 구분하여 현재 및 과거 상태를 제공합니다. Service Health 및 Resource Health 경고를 인시던트 관리에 통합하면 플랫폼이 근본 원인일 때 팀에 알림이 전달되므로, 정상적인 애플리케이션 구성 요소의 문제를 해결하는 데 소요되는 시간이 줄어듭니다. 이러한 신호를 Azure Monitor 경고와 결합하면 애플리케이션 성능, 인프라 사용률, 플랫폼 가용성을 하나의 운영 그림으로 보여주는 풀스택 가시성을 얻을 수 있습니다.
운영 제어를 위한 관리 도구
운영 작업은 대화형 문제 해결, 스크립트 기반 자동화, 모바일 분류(triage) 등 다양한 범위를 포괄합니다. Azure portal은 서비스 구성, 메트릭 시각화, 컨텍스트 내에서 직접 Cloud Shell 시작 등을 위한 포괄적인 역할 기반 환경을 제공합니다. Azure mobile app은 이동 중 상태 확인, 경고 승인, VM 재시작과 같은 빠른 작업을 지원합니다. CI/CD와의 반복성 및 통합을 위해 Azure CLI와 Azure PowerShell은 Microsoft Entra ID를 통한 일관된 인증으로 크로스플랫폼 자동화를 제공하며, 대화형 및 비대화형 흐름을 모두 지원합니다. Cloud Shell은 Bash 및 PowerShell을 갖춘 안전한 브라우저 기반 터미널을 제공하며, Azure CLI, Az PowerShell 모듈, 그리고 Git 및 Terraform과 같은 일반적인 도구들이 사전 로드되어 있습니다. 세션은 Microsoft가 유지 관리하는 컨테이너에서 실행되며, Azure Files 공유를 통해 사용자 프로필과 스크립트가 유지됩니다. 이를 통해 로컬 도구 환경의 차이(drift)를 없애고, 런타임 환경을 관리할 필요 없이 포털에서 실행되는 JIT(Just-In-Time) 운영을 단순화합니다. 장기 실행 또는 높은 처리량의 자동화를 위해서는 파이프라인이나 컨테이너화된 러너에서 CLI/PowerShell을 호스팅하고, 관리 ID 또는 페더레이션 자격 증명을 사용하여 인증함으로써 보안 암호가 무분별하게 확산되는 것을 방지합니다.
- Azure portal
- 인터페이스: 웹 UI
- 최적 용도: 구성, 시각화, 임시(ad-hoc) 작업
- 주요 강점: 풍부한 UX, 폭넓은 서비스 커버리지, 통합된 Cloud Shell
- 한계: 수동 방식, 대규모 스크립팅에는 적합하지 않음
- Azure mobile app
- 인터페이스: iOS/Android
- 최적 용도: 분류(Triage) 및 빠른 조치
- 주요 강점: 경고 승인, 기본 리소스 작업, 이동 중 액세스
- 한계: 제한적인 구성 깊이
- Cloud Shell
- 인터페이스: 브라우저 셸
- 최적 용도: 로컬 설정 없이 임시(ad-hoc) 명령 실행
- 주요 강점: 사전 설치된 도구, Azure Files를 통한 영구적인 홈 디렉토리, 보안 컨텍스트
- 한계: 임시 컨테이너, 장기 실행 배치 작업에는 부적합
- Azure CLI (az)
- 인터페이스: 명령줄
- 최적 용도: 크로스플랫폼 스크립팅 및 파이프라인
- 주요 강점: 일관된 구문, JSON 출력, 확장성
- 한계: 복잡한 리소스 그래프에 대한 학습 곡선
- Azure PowerShell (Az)
- 인터페이스: PowerShell 모듈
- 최적 용도: Windows/Linux/macOS 자동화, 객체 중심 운영
- 주요 강점: 풍부한 cmdlet 커버리지, 파이프라인 가능한 객체
- 한계: 비교적 무거운 설치 공간(footprint), 모듈 수명 주기 관리 필요
자동화: Runbook, 업데이트 관리, 비용 효율적인 VM 스케줄링
Azure Automation은 운영 작업을 오케스트레이션하기 위한 관리형 Runbook 서비스를 제공합니다. Runbook은 PowerShell, Python 또는 그래픽 워크플로로 작성할 수 있으며, 일정, 웹후크 또는 작업 그룹을 통한 경고에 의해 트리거될 수 있습니다. 실행 계정(Run-as account)은 관리 ID(managed identity)로 발전하여, 인증서 및 보안 암호 처리를 제거하는 동시에 세분화된 최소 권한 액세스를 지원합니다. Hybrid Runbook Worker는 자동화를 프라이빗 네트워크나 엣지 로케이션으로 확장하여, Azure에서 관리하면서 온프레미스 또는 격리된 리소스에 대해 Runbook을 실행합니다. 패치 거버넌스는 Azure Update Manager를 통해 처리되며, 이는 Azure VM 및 Arc 지원 서버 전반에 걸쳐 Windows 및 Linux 운영 체제 업데이트를 통합합니다. 유지 관리 구성은 일정, 재부팅 동작, 사전/사후 스크립트, 그리고 태그나 저장된 쿼리를 사용한 동적 범위를 정의합니다. 규정 준수 보고는 누락된 업데이트와 배포 성공 여부를 강조하며, Azure Policy와의 통합을 통해 기준 구성을 강제합니다. Update Manager는 Azure Automation의 레거시 업데이트 관리 솔루션을 대체하며, 향상된 확장성, 세분성 및 Arc 네이티브 지원을 제공합니다. 24x7 워크로드가 아닌 경우 컴퓨팅 비용을 최소화하기 위해, Azure는 일정에 따라 가상 머신을 중지하고 시작하는 여러 옵션을 제공합니다. Start/Stop VMs v2 솔루션은 내부적으로 Azure Automation과 Azure Monitor를 사용하여 태그 기반 타겟팅, 시간대별 업무 시간 일정, 유휴 상태 감지, 선택적 알림 등을 오케스트레이션합니다. 개별 VM도 자동 종료 정책을 지원하며, Virtual Machine Scale Sets는 메트릭 기반의 자동 크기 조정 규칙을 사용할 수 있습니다. 메트릭 기반 스케일링과 예약된 중지/시작을 결합하면 수요가 많은 시간대의 서비스 수준을 희생하지 않으면서 예측 가능한 비용 절감을 얻을 수 있습니다.
하이브리드 및 교차 테넌트 운영: Azure Arc, Azure Lighthouse, 그리고 교차 작업 영역 Kusto
Azure Arc는 Azure 외부의 리소스(서버, Kubernetes 클러스터, SQL Server 인스턴스 등)를 Azure Resource Manager로 투영하여 네이티브 리소스처럼 태그를 지정하고, 정책을 할당하고, 모니터링하고, 업데이트할 수 있도록 합니다. Azure Monitor 에이전트와 데이터 수집 규칙(Data Collection Rules)은 Arc 지원 머신에서 원격 분석 데이터를 하나 이상의 Log Analytics 작업 영역으로 푸시하여 위치에 관계없이 중앙 집중식 가시성을 확보할 수 있게 합니다. Kubernetes의 경우, Arc는 선언적 클러스터 관리를 위해 Flux를 사용한 GitOps를 통합하고, Defender for Cloud, Prometheus 스크레이핑, 정책 적용을 위한 에이전트를 배포하는 확장을 지원합니다. Azure Lighthouse는 여러 Microsoft Entra ID 테넌트에 걸쳐 리소스를 대규모로 안전하게 관리할 수 있게 해주며, 서비스 제공업체나 여러 사업부를 지원하는 중앙 플랫폼 팀에 이상적입니다. 위임(Delegation)은 구독, 리소스 그룹 또는 리소스 범위에서 Azure RBAC를 통해 최소한의 권한(just-enough-access)을 부여하며, 모든 작업은 고객 테넌트에서 감사됩니다. 운영자는 단일 컨텍스트에서 여러 테넌트에 걸쳐 로그를 쿼리하고, 정책을 배포하고, 자동화를 실행할 수 있어 로그인 마찰을 줄이고 테넌트 간 자격 증명 확산을 제거합니다. Kusto Query Language는 단일 문에서 여러 작업 영역과 Application Insights 리소스를 쿼리하여 리소스 및 지역 간 분석을 지원합니다. 일반적인 패턴으로는 작업 영역 간 union과 애플리케이션 추적과 인프라 로그를 연관시키기 위한 join이 있습니다. 예시:
undefined
. 또 다른 예시는 두 앱의 요청과 예외를 연관시킵니다:
undefined
. DCR 기반 다중 대상 라우팅을 사용하면 Arc 및 Azure 리소스의 로그를 지역별 작업 영역에 저장하면서도 집계하여 쿼리할 수 있으므로, 데이터 상주(data residency)와 글로벌 분석을 모두 제공할 수 있습니다.
실전 문제: GlobalRetail Co.의 하이브리드 환경을 위한 운영 신경망 센터 구축
시나리오: GlobalRetail Co.는 1,200개 매장에서 POS(point-of-sale) 서비스를 운영하고 있으며, 더블린과 싱가포르에 지역 데이터 센터를, 웹 및 분석 워크로드를 위해 점점 더 커지는 Azure 환경을 보유하고 있습니다. 경영진은 단일 운영 뷰, 자동화된 패치 적용, 개발 VM에 대한 비용 제어를 원하며, 외부 MSP(Managed Service Provider)가 모든 환경에 걸쳐 야간 지원을 처리합니다.
과제: Azure와 온프레미스 서버 전반에 걸쳐 모니터링 및 경고 통합, 유지 관리 기간(maintenance window)을 이용한 자동화된 OS 업데이트 구현, 개발/테스트 환경의 업무 시간 외 VM 비용 절감, 그리고 영구적인 자격 증명을 공유하지 않고 MSP를 위한 안전한 교차 테넌트 운영 활성화.
권장 접근 방식:
- 모든 온프레미스 Windows 및 Linux 서버에 Azure Arc를 배포합니다. 데이터 수집 규칙(Data Collection Rules)을 통해 Azure Monitor 에이전트를 활성화하여 플랫폼, syslog/이벤트, 성능 데이터를 지역별 Log Analytics 작업 영역으로 전송합니다.
- OpenTelemetry를 사용하여 웹 및 API 워크로드에 Application Insights를 계측합니다. 여러 지역에서 가용성 테스트를 구성하고 적응 샘플링(adaptive sampling) 및 스마트 검색(smart detection)을 활성화합니다.
- 중요 신호에 대해 Azure Monitor 메트릭, 로그, 활동 로그 경고를 생성합니다. 작업 그룹(action group)으로 알림을 중앙 집중화하여 이메일, 웹훅을 통한 Teams 알림, ITSM 커넥터를 트리거하여 자동으로 인시던트를 생성하도록 합니다.
- App Insights 장애/지연 시간, VM 성능(InsightsMetrics), 플랫폼 활동 로그를 결합한 운영 통합 문서(Workbook)를 게시합니다. 핵심 차트를 조직 전체의 Azure 대시보드에 고정합니다.
- 지역 및 매장 유형별 유지 관리 구성을 사용하여 Azure Update Manager를 구현합니다. 사전 스크립트(pre-script)를 사용하여 트래픽을 비우고 사후 스크립트(post-script)를 사용하여 서비스 상태를 검증합니다. Azure Policy 할당을 통해 규정 준수를 강제합니다.
environment=dev및environment=test태그를 사용하여 개발/테스트 구독을 대상으로 하는 Start/Stop VMs v2를 배포합니다. 현지 시간대별로 업무 시간 일정을 정의하고 사용량이 적은 기간 동안 유휴 상태 중지(idle-stop)를 활성화합니다.- 사용자 지정 최소 권한 역할을 사용하여 관리 그룹 수준에서 Azure Lighthouse 위임을 통해 MSP를 온보딩합니다. PIM을 사용한 JIT(Just-In-Time) 권한 상승을 요구하고, 활동 로깅이 계측된 비상 접근(break-glass) Runbook으로 사용을 제한합니다.
- 더블린과 싱가포르 작업 영역을
union하여 전체 시스템의 CPU, 메모리, 오류율을 확인하는 KQL 쿼리를 작성합니다. 급증을 감지하고 업무 시간 외에는 MSP의 작업 그룹으로 라우팅하도록 로그 경고를 예약합니다. - 영향을 받는 지역/서비스에 대해 Service Health 및 Resource Health 경고를 구성합니다. 권고 및 근본 원인 분석(RCA) 링크를 인시던트 레코드에 게시하는 인시던트 자동화를 생성합니다.
Azure 도입의 근거: Azure Arc는 Azure 외부 서버에 대한 거버넌스와 원격 분석을 표준화하여 Azure Monitor가 여러 지역의 메트릭과 로그를 통합할 수 있게 합니다. Application Insights는 엔드투엔드 트랜잭션 가시성을 제공하여 운영팀이 인프라 문제와 애플리케이션 오류를 정확히 구분할 수 있도록 합니다. 작업 그룹과 ITSM 통합은 시기적절하고 자동화된 인시던트 생성을 보장하며, 통합 문서와 대시보드는 공유된 운영 현황을 제공합니다. Update Manager는 유지 관리 기간 내에 일관된 패치 위생을 강제하고, Start/Stop VMs v2는 생산성에 영향을 주지 않으면서 개발/테스트 비용을 절감합니다. Azure Lighthouse는 MSP에게 여러 테넌트에 걸쳐 안전하고 감사 가능하며 최소 권한을 가진 액세스를 부여하고, 교차 작업 영역 KQL은 글로벌 원격 분석 데이터를 통합하여 사전 감지 및 신속한 진단을 가능하게 합니다.
← 거버넌스 및 규정 준수 · 모든 도메인 · 지원 →
이 문제 연습하기 → · ExamRoll.io에서 시간 제한 연습 →
Pass the whole exam — not just this question
You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.
시험 합격하기 →