Microsoft AZ-900: 支持、服务生命周期与 Marketplace — 学习指南
属于 Microsoft Azure AZ-900 — 学习指南. 使用经过验证的答案练习: Microsoft 考试中心, 或参加限时模拟考试: ExamRoll.io.
在 Azure 上实现可靠的运营取决于选择正确的支持模式、理解服务健康状况信号、根据已发布的服务级别协议 (SLA) 进行设计,以及通过商业市场负责任地采购第三方解决方案。该领域重点关注 Microsoft 如何在云工作负载的整个生命周期中为其提供支持,以及客户如何通过案例管理、配额增加、健康警报和事件处理来实施该支持。同样重要的是围绕持续变更的治理。Azure 服务遵循现代生命周期,提供频繁、安全的更新,并为重大变更提供提前通知。Azure Marketplace 通过经过验证的合作伙伴解决方案扩展了平台,从而能够在统一的 Azure 计费和策略控制下快速采用安全、网络、数据和应用程序组件。
Azure 支持计划和案例管理
Microsoft 提供多种 Azure 支持计划,以适应不同的工作负载关键性和所需的咨询指导级别。每个订阅都包含基本支持,且仅涵盖计费和订阅管理。开发人员支持面向非生产环境,在工作时间内为较低严重性的问题提供技术指导。标准支持是获得 24x7 技术支持的入门级选择,适用于大多数生产工作负载。Professional Direct (ProDirect) 增加了更快的响应目标,并提供主动咨询指导、架构审查和网络研讨会,以加速部署。Premier/Unified 是一个企业级保护伞,涵盖 Microsoft 云和本地产品,为您的组织配备客户成功客户经理 (Customer Success Account Manager) 和主动服务,例如服务审查、研讨会、就绪性规划和事件管理协调。支持请求在 Azure 门户的“帮助 + 支持”下创建。案例类型包括技术、计费、订阅管理以及服务和订阅限制(配额)。技术案例需要付费计划(开发人员、标准、ProDirect 或统一支持)。内置的“支持请求参与者”角色允许用户在不授予更广泛资源权限的情况下开启和管理案例,而“所有者”和“参与者”也可以提交案例。案例可以通过 Azure Monitor 操作组和 ITSM 连接器与 ITSM 工具集成,以维护单一的事件队列。
- 基本
- 技术支持可用性:无(仅限计费/订阅)
- 初始响应目标 (严重性 A/B/C):不适用
- 咨询指导:仅限文档、社区
- 主动服务:无
- 典型用途:试用、学习、非关键帐户
- 开发人员
- 技术支持可用性:工作时间(电子邮件/Web)
- 初始响应目标 (严重性 A/B/C):不适用 / 不适用 / < 8 小时
- 咨询指导:常规操作方法指导
- 主动服务:无
- 典型用途:开发/测试和试点
- 标准
- 技术支持可用性:严重性 A 为 24x7;较低严重性为工作时间
- 初始响应目标 (严重性 A/B/C):< 1 小时 / < 4 小时 / < 8 小时
- 咨询指导:通过案例提供尽力而为的指导
- 主动服务:无
- 典型用途:具有标准响应需求的生产工作负载
- Professional Direct
- 技术支持可用性:严重性 A 为 24x7
- 初始响应目标 (严重性 A/B/C):< 1 小时 / < 2 小时 / < 4 小时
- 咨询指导:主动咨询、架构审查、入门指导
- 主动服务:网络研讨会、服务审查、升级管理
- 典型用途:需要更快响应和指导的业务关键型生产
- Premier/Unified
- 技术支持可用性:24x7(广泛的 Microsoft 产品范围)
- 初始响应目标 (严重性 A/B/C):< 1 小时 / < 2 小时 / < 4 小时
- 咨询指导:指定的 CSAM、解决方案级指导
- 主动服务:研讨会、评估、服务审查、事件协调
- 典型用途:跨多种产品的企业产品组合
创建支持请求以及提高配额和限制
支持请求源自 Azure 门户中的“帮助 + 支持”>“创建支持请求”。工作流会提示您输入问题类型、订阅、服务、资源、区域和严重性。对于技术案例,您需要选择一个与业务影响和您计划的响应目标相符的影响级别(严重性)。提供诊断信息(时间戳、相关 ID、指标和变更历史记录)以加快分类处理速度。对于计费和订阅管理,基本支持就足够了;对于技术问题,则需要付费计划。配额和限制的增加请求以“服务和订阅限制(配额)”的形式提交。常见的请求包括按区域的计算 vCPU 配额(按 VM 系列)、公共 IP 地址、专用 GPU 或 HPC 系列的核心数,以及 Azure Machine Learning 或 Cognitive Services 的配额。计算配额按每个订阅、每个区域和每个 VM 系列强制执行;请求更高的配额可以启用容量请求,但不能保证容量的可用性。为了获得可预测的容量,请将配额增加与按需容量预留相结合,或在适当时规划区域性部署。提交请求的访问权限通过 Azure RBAC 进行控制。“支持请求参与者”角色可以在不授予资源修改权限的情况下创建和管理票证。大型组织通常通过内部审批来处理配额工作流,并在 ITSM 中进行跟踪;Azure Quota API 可以在预定义阈值下自动执行监控和提出请求。提交后,案例会在需要时分流给工程团队,并通过门户、电子邮件进行沟通,对于更高严重性的问题,还可以选择通过电话沟通。
事件管理中的服务运行状况、计划内维护和 SLA
Azure 提供多种运行状况视图。Azure Status 是平台级问题的公开全局视图。Azure Service Health 针对您的订阅提供个性化视图,显示影响您所在区域和资源的服务问题、计划内维护和运行状况通告。Resource Health 深入探查单个资源的状态,提供近期的可用性事件和根本原因,例如平台事件、用户发起的操作或底层硬件故障。Service Health 警报与操作组集成,支持电子邮件、短信、语音、Webhook、ITSM 连接器和 Azure Functions。计划内维护通过 Service Health 进行传达,并附有预期的时间窗口和影响详情。对于虚拟机,Azure Scheduled Events 会(通过实例元数据服务)在虚拟机内部暴露即将发生的操作(如重启)的通知,从而允许应用程序进行连接排空、创建检查点或执行故障转移。Maintenance Control 适用于 Azure Dedicated Hosts 和某些隔离的 VM 大小,它使管理员能够在定义的延迟窗口内推迟平台维护,以便与变更控制流程保持一致。SLA 定义了每项服务的月度正常运行时间或事务成功率目标。在设计多服务解决方案的架构时,组合可用性是所有依赖项可用性的乘积。更高的可用性级别通常需要区域冗余或多实例部署。例如,在同一区域内的两个或多个可用性区域中运行虚拟机,可以获得比单个 VM 或可用性集更高的 SLA。如果未能达到 SLA,可以通过索赔获得服务积分;请在规定期限内通过门户网站提交申请并附上证据(时间戳、受影响的资源),并在 Service Health 中跟踪事件和事后审查报告。
| 服务 | SLA 的关键要求 | 发布的 SLA(典型值) | 备注 |
|---|---|---|---|
| 虚拟机(单实例) | 操作系统和数据盘使用 Premium SSD 或 Ultra Disk | 99.9% | 适用于符合条件的 VM 大小和存储;未使用可用性集/区域 |
| 可用性集中的虚拟机 | 跨故障/更新域部署两个或更多实例 | 99.95% | 降低单机架和更新域风险 |
| 跨可用性区域的虚拟机 | 在同一区域内的多个区域中部署两个或更多实例 | 99.99% | 无需跨区域故障转移的最佳区域内恢复能力 |
| Azure SQL Database(单一数据库) | 标准部署 | 99.99% | 区域冗余可以提高对区域性故障的恢复能力 |
| App Service(多实例) | 两个或更多实例 | 99.95% | 需要 Basic 或更高层级并配置多个实例 |
新式生命周期策略和 Azure Marketplace
Azure 服务遵循新式生命周期策略,该策略强调持续的服务更新和客户保持更新的责任。需要客户采取行动的重大变更会提前通知——对于在线服务,通常至少提前 12 个月——通过正式的弃用公告、Service Health 通告和文档更新进行传达。Azure 会提供停用时间表、API 版本控制和迁移路径,以便工作负载可以在符合企业治理的变更窗口内进行修复。这种持续交付模型利用了安全部署实践,包括分阶段推出和自动缓解措施。运维就绪意味着需要跟踪服务通告,在预生产环境中验证新的运行时或 SDK 版本,并使用功能标志或蓝绿部署模式进行应用程序更新。安全和合规性更新无需单独的安装周期即可送达,这缩短了风险暴露窗口,同时强调了可观察性和发布纪律。Azure Marketplace 通过第三方解决方案扩展了平台:包括虚拟机映像、托管应用程序、Kubernetes 应用和 SaaS 产品。这些产品通过您的 Azure 订阅计费,提供多种选项,例如即用即付计量、年度/定期计划以及自带许可证 (BYOL)。企业可以策划一个私有市场,只允许经批准的发布者或产品,应用 Azure Policy 来限制部署范围(例如区域、SKU、网络),并通过私有产品/服务协商自定义定价。网络虚拟设备(例如防火墙、负载均衡器)、数据平台、安全分析和可观察性堆栈是常见的模式;发布者支持是这些解决方案的主要渠道,而计费则统一在 Azure 中。
| 产品类型 | 部署模型 | 计费模型 | 用例示例 | 运维说明 |
|---|---|---|---|---|
| 虚拟机映像(NVA 或服务器) | 在您的 VNet 中部署 ARM 模板/VM | 即用即付 (PAYG) 或自带许可证 (BYOL) | 防火墙、WAF、IDS/IPS、打包的应用程序 | 您负责管理 VM 的生命周期、扩展和修补 |
| 托管应用程序 | 部署到您的订阅中,由发布者管理 | 即用即付 (PAYG) 外加管理费 | 提供托管运维的统包解决方案 | 发布者更新核心组件;您管理数据/配置 |
| Kubernetes 应用(AKS 加载项) | 通过 Helm/ARM 部署到您的 AKS 集群中 | 即用即付 (PAYG) 或自带许可证 (BYOL) | Ingress 控制器、服务网格、Operator | 您管理 AKS;发布者维护应用容器映像 |
| SaaS | 在发布者的租户中运行;与您的租户集成 | 订阅/消费 | API、分析平台、安全 SaaS | 实现价值最快;需要管理的基础设施最少 |
实践问题:Coastal Outfitters:为应对季节性电子商务高峰,将支持、运行状况和市场解决方案投入运营
场景: Coastal Outfitters 运营一个托管在 Azure 上的电子商务网站,该网站在大部分时间流量平稳,但在月底有为期四天的流量激增。其架构使用 Azure Application Gateway、两个基于 VM 的 Web 层和一个托管数据库。安全方面要求部署下一代防火墙,而运维团队必须在流量激增期间保证 Web 层 99.99% 的可用性,并在部署过程中获得前瞻性指导。
挑战: 选择正确的支持计划以获得前瞻性架构指导,在治理框架下部署市场防火墙,在流量激增前提高区域计算配额,并实施符合 99.99% 可用性目标的运行状况警报和事件工作流。
推荐方法:
- 将订阅升级到 Professional Direct 支持计划,以确保为生产环境的部署获得 24x7 的关键问题响应和前瞻性咨询指导。
- 将内置的“支持请求参与者”角色分配给 NOC 团队,以便他们可以在没有广泛资源权限的情况下创建和管理支持票证。
- 从 Azure Marketplace 将 Palo Alto Networks 或 Fortinet 下一代防火墙部署到专用的中心 VNet 中;利用私有市场,以便只有经过批准和协商的私有产品/服务对订阅所有者可见。
- 将两个或更多 Web VM 放置在 Application Gateway 后面的不同可用区中,以满足 99.99% 的 VM SLA;将操作系统/数据存储在 Premium SSDs 上。
- 在流量激增前两周,提交“服务和订阅限制(配额)”请求,以增加所需 VM 系列的区域 vCPU 配额;为 Web 层添加容量预留,以保证突发容量。
- 为网站所在区域的服务问题、计划内维护和运行状况通报配置 Azure Service Health 警报;将警报路由到一个操作组,该操作组通过电子邮件/短信通知待命人员,并通过 ITSM 连接器在 ServiceNow 中创建事件。
- 在 Web VM 上启用 Azure Scheduled Events 处理,以便在主机维护期间正常地排空连接;在预演环境中使用蓝绿部署切换来验证故障转移行为。
- 在运行手册中记录 SLA 信用额度索赔工作流,包括证据捕获(时间戳、资源 ID、指标),并确保在未达到可用性目标时,在允许的时间窗口内通过门户提交索赔。
Azure 方案原理: Professional Direct 计划结合了快速响应和前瞻性咨询的优势,且没有企业级 Unified 协议的开销,非常适合单一关键生产工作负载。区域性虚拟机以最少的实例数量将可用性级别提升至 99.99%,而 Premium SSDs 则满足了单实例存储的要求。精选的私有市场和协商的私有产品/服务可确保安全设备合规且成本可控,而发布商支持仍然是解决 NVA 问题的第一道防线。提前增加配额和容量预留消除了流量激增期间的部署阻力。Service Health 警报、计划事件处理和 SLA 索赔运行手册以明确的职责和证据路径完成了事件管理的闭环。
练习这些题目 → · 在 ExamRoll.io 上限时练习 →
Pass the whole exam — not just this question
You found this answer. Get every verified question and explanation in one place, and save hours of prep. Free to start.
通过考试 →