AmazonAmazon ML Engineer Associate MLA-C01 Certification
·CN
·更新于 4 Aug 2026
一个基于 CPU 的模型将在工作时间处理具有间歇性流量的实时预测,并在非工作时间处于空闲状态。哪种 SageMaker 托管选项对于这种模式最具成本效益?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 将模型部署到 SageMaker Serverless Inference 端点。在工作时间配置增加的预置并发。.
为什么这是答案
SageMaker Serverless Inference 端点最适合间歇性流量模式,因为它按实际使用量计费,当没有请求时,它会自动缩容到零,从而避免了空闲成本。在工作时间配置预置并发可以确保在流量高峰期有足够的容量,同时保持成本效益。
将模型部署到 SageMaker 实时端点并使用基于计划的自动扩缩策略,虽然可以处理流量高峰,但当流量为零时,端点仍会保持至少一个实例运行,产生不必要的成本。SageMaker Asynchronous Inference 端点适用于处理大批量、非实时或长运行时间的推理任务,不适用于实时预测。通过 Lambda 函数激活实时端点过于复杂,且实时端点在不使用时仍会产生费用。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡