MediLex 針對 NLP 推論 API 部署了一個 SageMaker 即時端點 (ml.m5.large 實例)。CloudWatch 指標顯示,在過去 5 分鐘的尖峰時段內,平均每分鐘有 800 次調用,而 InvocationsPerInstance 指標為每分鐘 100 次調用。該端點目前運行 8 個實例。SRE 團隊希望在維持相同尖峰流量的同時,將每個實例的負載保持不變 (目標為每個實例 150 次調用),以實現資源最佳化。使用 CloudWatch InvocationsPerInstance 或聚合調用數據,他們應該佈建多少個實例才能達到每個實例 150 次調用的目標?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 6 個實例.
為什麼這是答案
正確答案是 6 個實例。目前每分鐘總調用次數為 800 次。如果目標是每個實例每分鐘處理 150 次調用,那麼所需的實例數量計算方式為:總調用次數 / 目標每實例調用次數 = 800 / 150 ≈ 5.33。由於實例數量必須是整數,因此需要向上取整到 6 個實例,以確保每個實例的負載不超過目標。 選項 4 個實例會導致每個實例的負載增加到 200 次調用 (800/4),這超過了目標 150 次。選項 8 個實例會導致每個實例的負載降低到 100 次調用 (800/8),這未能達到資源最佳化的目標。選項 10 個實例會進一步降低負載到 80 次調用 (800/10),這也不是最佳選擇。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡