AmazonAmazon ML Engineer Associate MLA-C01 Certification
·CN
·更新于 4 Aug 2026
DataWave Inc. 在 SageMaker 实时端点(单个生产变体)上运行低延迟欺诈模型。他们希望通过将 5% 的实时生产流量路由到新的模型变体(影子)来执行影子测试,而 95% 的流量继续流向当前变体;影子模型的响应不应返回给客户端(它们将被记录下来以供离线比较)。在 SageMaker 中实现此目的最合适、侵入性最小的方法是什么?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 创建一个新的生产变体,并在 EndpointConfig 中将其 InitialVariantWeight 设置为 0.05(或调用 UpdateEndpointWeightsAndCapacities 来设置权重)。端点将根据权重拆分实时请求;在本地记录影子变体的响应以进行比较。.
为什么这是答案
正确答案描述了 SageMaker 端点中影子测试的标准方法。通过在 EndpointConfig 中为新模型变体设置 InitialVariantWeight 为 0.05(或使用 UpdateEndpointWeightsAndCapacities),SageMaker 会自动将 5% 的实时流量路由到影子模型。由于影子测试的目的是离线比较,SageMaker 不会将影子模型的响应返回给客户端,而是允许您记录这些响应进行分析。这是一种非侵入性且内置的 SageMaker 功能。
将影子模型的响应通过客户端逻辑丢弃会增加客户端复杂性,并且可能在网络延迟方面误导客户端。使用 Application Load Balancer (ALB) 引入了额外的基础设施和管理开销,并且请求镜像功能通常用于调试,而不是生产影子测试。多模型端点适用于在单个端点上托管多个模型,但其主要目的是基于 TargetModel 路由请求,而不是进行影子测试,并且需要自定义的路由逻辑,增加了复杂性。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡