Adverto 正在评估 SageMaker Serverless Inference 与始终在线的实时端点,以处理一批流量高度不规律(数分钟零请求,偶尔爆发)的模型。关于 Serverless Inference 成本模型与始终在线的实时端点相比,哪种说法最能准确地说明在此工作负载中实现成本最小化?
选择一个答案
点击一个选项来检查您的答案。
正确答案: Serverless Inference 按调用次数和计算持续时间(GB-秒)计费;与始终在线的实时端点(即使空闲也按实例小时计费)相比,它通常更适用于不规律、低占空比的流量,成本更低.
为什么这是答案
SageMaker Serverless Inference 按调用次数和计算持续时间(以 GB-秒为单位)计费。这意味着当模型处于空闲状态时,不会产生计算费用,非常适合流量高度不规律或低占空比的工作负载。相比之下,始终在线的实时端点即使在没有请求时也会持续运行并按实例小时计费,导致在空闲期间产生不必要的成本。因此,对于题目描述的流量模式,Serverless Inference 通常能实现更高的成本效益。 其他选项不正确: Serverless Inference 没有固定的月费,也并非在请求量超过某个阈值后变得更便宜。 始终在线的实时端点即使空闲也会产生实例小时费用,因此对于不规律的工作负载,它们通常不如无服务器划算。 Serverless Inference 的定价模型与 Lambda 相似,但没有明确的“免费套餐”或保证低容量生产免费,而是按实际使用量计费。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡