一家公司将在 SageMaker 端点上部署模型以进行生产推理。典型的请求负载介于 100 MB 和 300 MB 之间,每个请求必须在 60 分钟内完成。应该使用哪种 SageMaker 推理选项?
选择一个答案
点击一个选项来检查您的答案。
正确答案: Asynchronous inference.
为什么这是答案
正确答案是异步推理。异步推理适用于大型有效负载(最高 1 GB)和长处理时间(最长 1 小时)的请求,这与题目中 100-300 MB 的请求负载和 60 分钟内完成的要求相符。 实时推理不适合,因为它通常用于低延迟、小有效负载(最高 5 MB)的请求。无服务器推理虽然可以处理高达 40 MB 的有效负载,但其处理时间通常限制在 60 秒以内,不符合 60 分钟的需求。批量转换适用于离线处理大量数据,而不是单个请求的推理。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡