Microsoft AZ-900: 監視、自動化與管理 — 學習指南

屬於 Microsoft Azure AZ-900 — 學習指南. 使用經過驗證的解答練習: Microsoft 考試中心, 或參加限時模擬考試: ExamRoll.io.

Azure 的維運卓越,仰賴於可觀測的平台、可重複的自動化,以及橫跨雲端與混合式環境的統一治理。Azure Monitor 為指標、記錄、追蹤及端對端的應用程式洞察,提供了遙測骨幹。管理工具——從 Azure 入口網站到 CLI 和 PowerShell——讓團隊能根據這些洞察進行大規模的行動。自動化服務,搭配 Azure Arc 和 Azure Lighthouse,能將控制能力延伸至任何地方的伺服器與叢集,並為服務供應商和中央 IT 單位簡化跨租用戶的操作。

Azure Monitor:指標、記錄、警示與應用程式洞察

Azure Monitor 收集兩種主要的訊號類型:指標 (metrics) 和記錄 (logs)。指標是輕量化的數值時間序列,針對儀表板和自動擴展等近乎即時的情境進行優化,通常保留 93 天。記錄是內容豐富、結構彈性的資料,儲存在 Log Analytics 工作區中,並可使用 Kusto 查詢語言 (KQL) 進行查詢。透過 Azure Monitor 代理程式和資料收集規則 (DCRs),來自 VM、已啟用 Arc 的伺服器以及平台診斷的資料,可以被路由到跨區域的一個或多個工作區,以進行集中式分析和長期保留。標準記錄的保留期是可設定的——通常為 30 到 730 天——並提供低成本的封存與重新啟用 (rehydration) 功能,以供歷史調查之用。Application Insights 建構在 Azure Monitor 之上,為應用程式提供分散式追蹤、相依性追蹤、可用性測試及自動異常偵測的檢測能力。它支援 OpenTelemetry 以進行廠商中立的資料擷取,讓開發人員能將用戶端、伺服器和資料庫的呼叫,關聯成單一的交易地圖。Live Metrics 提供無需取樣、每秒更新的伺服器遙測資料,而自動調整取樣則能在不失對重大故障的端對端追蹤能力下,降低資料擷取成本。警示功能橫跨資源、訂用帳戶和租用戶等範圍。指標警示以一分鐘的細微性評估時間序列閾值,並能透過動態閾值進行自動調整。記錄警示會執行排程的 KQL 查詢,以偵測跨資源和區域的複雜模式;而活動記錄警示則會在發生建立、更新或刪除等控制平面事件時觸發。動作群組 (Action groups) 將偵測與回應解耦,可觸發通知 (電子郵件、簡訊、推播、語音) 和自動化動作 (webhook/secure webhook、Logic Apps、Functions、Automation runbooks、ITSM 連接器)。隱藏規則和警示處理規則,有助於在計劃性維護期間將警示靜音或進行路由,以減少雜訊。儀表板 (Dashboards) 和活頁簿 (Workbooks) 以不同方式呈現遙測資料。Azure 儀表板是以磚格為基礎、跨服務的畫布,非常適合快速的維運檢視和釘選指標圖表。活頁簿則具分析性、參數化且可協同作業,它將指標、記錄和視覺效果與查詢驅動的互動性融合在一起。活頁簿在維運操作手冊、事件後分析和服務審查等情境中表現出色,操作人員可以在不離開當前情境的情況下,跨維度進行分析並鑽研原始資料。

Service Health 與資源復原力訊號

平台的可用性與維護,需要在資源指標之外進行專門的監控。Azure Service Health 針對影響訂用帳戶中特定區域和服務的服務問題、計劃性維護和健康情況建議,提供個人化的可見度。它補充了公開的 Azure 狀態頁面,在可用時提供訂用帳戶範圍內的影響、時間表和根本原因分析。可以設定健康情況警示,在區域性服務事件影響已部署工作負載的當下,立即透過動作群組通知維運團隊。Resource Health 專注於個別資源的狀態,例如虛擬機器、應用程式服務或資料庫。它會區分平台造成的中斷和使用者起始的事件,並提供目前和歷史的健康狀態。將 Service Health 和 Resource Health 警示與事件管理整合,可確保當平台是根本原因時團隊能收到通知,從而減少花在對健康應用程式元件進行故障排除的時間。將這些訊號與 Azure Monitor 警示結合,可在單一的維運畫面中,產生涵蓋應用程式效能、基礎架構使用率和平台可用性的全堆疊可見度。

混合式與跨租用戶營運:Azure Arc、Azure Lighthouse 與跨工作區 Kusto

Azure Arc 將非 Azure 資源——伺服器、Kubernetes 叢集、SQL Server 執行個體——投射至 Azure Resource Manager,使其能像原生資源一樣被加上標籤、指派原則、監控及更新。Azure Monitor 代理程式與資料收集規則 (Data Collection Rules) 將遙測資料從已啟用 Arc 的機器推送到一個或多個 Log Analytics 工作區,無論資源位於何處,都能實現集中式的可觀測性。對於 Kubernetes,Arc 將 GitOps 與 Flux 整合,以進行宣告式叢集管理,並支援擴充功能以部署 Defender for Cloud、Prometheus 抓取及原則強制執行的代理程式。Azure Lighthouse 能夠跨 Microsoft Entra ID 租用戶進行安全、大規模的資源管理,非常適合服務供應商或支援多個業務單位的集中式平台團隊。委派透過 Azure RBAC 在訂用帳戶、資源群組或資源範圍層級授予恰到好處的存取權限,同時所有操作都在客戶租用戶中進行稽核。操作人員可以從單一情境中跨租用戶查詢日誌、部署原則及執行自動化,從而減少登入的摩擦並消除跨租用戶的憑證擴散。Kusto 查詢語言 (Kusto Query Language) 透過在單一陳述式中查詢多個工作區和 Application Insights 資源,來支援跨資源和跨區域的分析。常見的模式包括跨工作區的聯集 (union),以及用來關聯應用程式追蹤與基礎架構日誌的聯結 (join)。範例:

undefined

。另一個範例是關聯兩個應用程式的請求和例外狀況:

undefined

。透過基於 DCR 的多目的地路由,來自 Arc 和 Azure 資源的日誌可以存放在區域性工作區中,同時仍可進行匯總查詢,兼顧了資料落地和全域分析的需求。

實務問題:GlobalRetail Co. 為混合式資產建立營運神經中樞

情境: GlobalRetail Co. 在 1,200 家門市中營運銷售點 (point-of-sale) 服務,並在都柏林和新加坡設有區域資料中心,同時其用於網站和分析工作負載的 Azure 版圖也在不斷增長。領導階層希望有一個單一的營運視圖、自動化修補,以及對開發用 VM 的成本控制,同時由外部的託管服務供應商 (MSP) 處理所有環境的夜間支援。

挑戰: 統一跨 Azure 和地端伺服器的監控與警示,實作具備維護時段的自動化作業系統更新,降低開發/測試環境中非上班時間的 VM 成本,並為 MSP 啟用安全的跨租用戶營運,而無需分享永久性憑證。

建議方法:

  1. 在所有地端的 Windows 和 Linux 伺服器上部署 Azure Arc;透過資料收集規則 (Data Collection Rules) 啟用 Azure Monitor 代理程式,將平台、syslog/事件以及效能資料傳送到區域性的 Log Analytics 工作區。
  2. 使用 OpenTelemetry 透過 Application Insights 來檢測網站與 API 工作負載;從多個區域設定可用性測試,並啟用自動調整取樣與智慧偵測。
  3. 針對關鍵信號建立 Azure Monitor 計量、日誌與活動日誌警示;使用動作群組集中通知,以觸發電子郵件、透過 webhook 傳送到 Teams,以及透過 ITSM 連接器自動開啟事件。
  4. 發佈營運用的 Workbooks,結合 App Insights 的失敗/延遲、VM 效能 (InsightsMetrics) 以及平台活動日誌 (Activity Logs);將關鍵圖表釘選到全組織的 Azure 儀表板。
  5. 實作 Azure Update Manager,並為每個區域和門市類型設定維護組態;使用前置指令碼來清空流量,並使用後置指令碼來驗證服務健康狀態;透過 Azure Policy 指派來強制執行合規性。
  6. 推出 Start/Stop VMs v2,使用標籤

undefined

undefined

鎖定開發/測試訂用帳戶;根據當地時區定義上班時間排程,並在低使用率時段啟用閒置停止功能。 7. 透過 Azure Lighthouse 在管理群組層級進行委派,讓 MSP 上線,並使用自訂的最低權限角色;要求使用 PIM 進行即時 (just-in-time) 權限提升,並限制其只能使用具備活動日誌記錄功能的緊急應變 (break-glass) runbook。 8. 撰寫 KQL 查詢,將都柏林和新加坡的工作區進行聯集 (union),以監控整個機群的 CPU、記憶體與錯誤率;排程日誌警示以偵測突波,並在非上班時間將警示路由至 MSP 的動作群組。 9. 為受影響的區域/服務設定 Service Health 與 Resource Health 警示;建立一個事件自動化,將建議和根本原因分析 (RCA) 的連結張貼到事件記錄中。

Azure 理據: Azure Arc 為非 Azure 伺服器標準化了治理與遙測,讓 Azure Monitor 能夠整合跨區域的計量與日誌。Application Insights 提供端到端的交易可視性,使營運團隊能夠精準定位應用程式錯誤與基礎架構問題。動作群組與 ITSM 整合確保了及時、自動化的事件建立,而 Workbooks 和儀表板則提供了共享的營運圖像。Update Manager 在維護時段內強制執行一致的修補衛生,而 Start/Stop VMs v2 則在不影響生產力的情況下削減了開發/測試支出。Azure Lighthouse 授予 MSP 安全、可稽核、最低權限的跨租用戶存取權,而跨工作區的 KQL 則將全球的遙測資料整合在一起,以進行主動偵測與快速診斷。


治理與合規性 · 所有領域 · 支援、服務生命週期與 Marketplace

練習這些題目 → · 在 ExamRoll.io 上限時練習 →

Pass the whole exam — not just this question

You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.

通過考試 →

瀏覽 Microsoft →

Related guides

一站式存取

一份訂閱。所有考試。

每個方案都可無限存取答案搜尋、練習測驗、AI 解釋和完整的資源庫 — 支援 20 多種語言。

每月
24.87
Just €0.83/day
包含所有內容:
  • 無限答案搜尋
  • 無限練習測驗
  • AI 驅動的解釋
  • 完整資源庫
  • 20 多種語言
  • 每週內容更新
  • 獎勵與推薦
  • 優先支援
開始免費試用

無需信用卡*

最佳價值
12 個月
179.87
Just €0.49/daySave 40%
包含所有內容:
  • 無限答案搜尋
  • 無限練習測驗
  • AI 驅動的解釋
  • 完整資源庫
  • 20 多種語言
  • 每週內容更新
  • 獎勵與推薦
  • 優先支援
開始免費試用

無需信用卡*

✓ 包含免費方案 · ✓ 隨時取消 · ✓ 所有方案解鎖完整產品