AmazonAmazon ML Engineer Associate MLA-C01 Certification
·TW
·更新於 4 Aug 2026
BrightDrive 希望用 SageMaker Serverless Inference 取代低流量的即時 GPU 端點,以節省成本。他們需要控制並發性並了解延遲的權衡。哪項陳述最能準確描述如何配置無伺服器以及與持久性即時端點相比的權衡?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 使用 MaxConcurrency (例如 10) 和適當的記憶體大小配置 Serverless Inference;無伺服器將從零開始擴展,這可能會在首次請求時產生冷啟動延遲。無伺服器對於間歇性流量來說具有成本效益,但持久性即時端點提供更低、更一致的延遲,並支援 GPU 和預置容量。.
為什麼這是答案
此選項準確描述了 SageMaker 無伺服器推論的配置和權衡。您可以透過 MaxConcurrency 和記憶體大小來控制無伺服器端點。無伺服器端點會從零擴展,導致首次請求時可能出現冷啟動延遲,這對於低流量但間歇性的工作負載而言是可接受的成本節省。然而,持久性即時端點提供更低的、更一致的延遲,並支援 GPU 實例和預置容量,這對於需要高效能和低延遲的應用程式至關重要。
其他選項不正確的原因如下:
設定 ProvisionedConcurrency 確實可以減少冷啟動,但 SageMaker 無伺服器推論目前不支援 GPU 實例類型。
無伺服器推論確實有並發性設定 (MaxConcurrency),並且可以處理多個並發調用,而不僅限於單一調用。
即使設定了 MaxConcurrency,無伺服器推論也無法保證與即時端點相同的 p99 延遲,因為冷啟動仍然可能發生,並且其設計目標是成本效益而非最低延遲。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 →
無需信用卡