某个模型必须每晚运行一次,以预测次日股票价值。输入是当天收集的 3 MB 数据,推理在 1 分钟内完成。您应该如何在 Amazon SageMaker 中部署此模型以满足这些要求?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 使用无服务器推理端点并将 MaxConcurrency 设置为 1。.
为什么这是答案
正确答案是使用无服务器推理端点并将 MaxConcurrency 设置为 1。无服务器推理端点非常适合间歇性或不可预测的工作负载,例如每天运行一次的预测任务。它会自动扩展和缩减,无需预置实例,这意味着您只需为实际推理时间付费,这对于每天只运行一次的模型来说非常经济高效。将 MaxConcurrency 设置为 1 确保了在任何给定时间只处理一个请求,这与模型每天运行一次的性质相符。 使用多模型无服务器端点并启用缓存不适合,因为该场景只有一个模型,并且缓存对于每天运行一次的批处理任务没有显著优势。异步推理端点通常用于大型有效负载或长时间运行的推理,而此场景中数据量小(3MB)且推理时间短(1分钟)。实时端点并配置自动扩缩策略使其在空闲时扩缩到 0 也是一个可行的选项,但无服务器推理端点在管理和成本效益方面通常更优,因为它完全消除了实例管理。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡