AmazonAmazon ML Engineer Associate MLA-C01 Certification
·TW
·更新於 4 Aug 2026
MediaWatch 執行即時影片分類模型,並希望在模型執行時間增加時發出警示。應使用哪個 CloudWatch 指標來偵測僅限模型容器推論時間的增加,以及建議如何針對特定端點變體持續增加的情況發出警報?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 使用帶有 EndpointName 和 VariantName 維度的 AWS/SageMaker 'ModelLatency' 指標(這會測量模型容器中的時間)。針對 ModelLatency 在 5 分鐘期間內的 p90(或所需百分位數)統計資料建立 CloudWatch 警報,並將評估期間設定為 3,以偵測持續增加的情況。.
為什麼這是答案
正確答案是使用帶有 EndpointName 和 VariantName 維度的 AWS/SageMaker 'ModelLatency' 指標,因為它專門測量模型容器內的推論時間,這正是問題所要求的。針對 ModelLatency 的 p90(或所需百分位數)統計資料建立警報,可以有效捕捉延遲的增加,而不是受單一異常值影響。將評估期間設定為 3(例如,在 5 分鐘期間內)有助於偵測持續的延遲增加,避免因暫時性波動而觸發誤報。
OverheadLatency 測量的是 SageMaker 處理請求的開銷,不包括模型容器內的推論時間。InvocationDuration 測量的是整個調用過程的持續時間,包括網路和 SageMaker 服務開銷,不單獨隔離模型容器時間。使用不帶維度的全域 ModelLatency 無法針對特定端點變體進行監控,且監控最小值無法偵測到延遲增加。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 →
無需信用卡