MediLex 为 NLP 推理 API 运行一个 SageMaker 实时端点(ml.m5.large 实例)。CloudWatch 指标报告,在过去 5 分钟的峰值间隔内,平均每分钟有 800 次调用,并且 InvocationsPerInstance 指标为 100 次调用/分钟。该端点目前运行 8 个实例。SRE 团队希望调整规模以满足相同的峰值流量,同时保持相同的每实例负载(目标为每实例 150 次调用)。使用 CloudWatch InvocationsPerInstance 或聚合调用数据,他们应该预置多少个实例才能达到每实例 150 次调用的目标?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 6 个实例.
为什么这是答案
当前每分钟总调用次数为 800 次调用/分钟。SRE 团队希望将每实例负载目标设置为 150 次调用/分钟。要计算所需的实例数量,我们将总调用次数除以目标每实例调用次数:800 次调用/分钟 ÷ 150 次调用/分钟/实例 ≈ 5.33 个实例。由于实例数量必须是整数,并且为了满足峰值流量,我们需要向上取整到 6 个实例。 选项 A (4 个实例) 和 选项 C (8 个实例) 不符合目标每实例调用次数。选项 D (10 个实例) 会导致每实例负载低于目标,效率较低。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡