某公司开发了两个模型:模型 A 用于检测欺诈性交易,将在每笔交易发生时调用;模型 B 用于预测下个月的销售额,每月调用一次。这两个模型都必须使用 SageMaker AI 部署到生产环境。该公司应该使用哪种托管方法?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 使用实时端点托管模型 A,并对模型 B 使用批量转换。.
为什么这是答案
模型 A 需要在每笔交易发生时立即响应,因此实时端点(Real-time Endpoint)是最佳选择,它能提供低延迟的预测。模型 B 每月调用一次,预测下个月的销售额,对延迟不敏感,且通常涉及大量数据处理,因此批量转换(Batch Transform)是更经济高效且适合这种离线、大批量预测任务的方法。 将两个模型托管在单个容器中并通过一个实时端点提供服务不符合各自的性能和成本需求。将模型 A 托管在异步端点上会引入不必要的延迟,不适合欺诈检测的即时性要求。对模型 A 使用批量转换会严重延迟欺诈检测,而使用异步端点托管模型 B 则会引入不必要的复杂性和成本,因为批量转换足以满足其需求。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡