某個模型必須每晚執行一次,以預測隔天的股票價值。輸入是當天收集的 3 MB 資料,推論會在 1 分鐘內完成。您應該如何在 Amazon SageMaker 中部署此模型以符合這些要求?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 使用無伺服器推論端點並將 MaxConcurrency 設定為 1。.
為什麼這是答案
正確答案是使用無伺服器推論端點並將 MaxConcurrency 設定為 1。無伺服器推論端點非常適合處理間歇性或不頻繁的推論請求,例如每天執行一次的模型。它會自動擴展以處理請求,並在沒有流量時擴展至零,從而優化成本。將 MaxConcurrency 設定為 1 可確保模型一次只處理一個請求,這符合每天執行一次的頻率,並且推論時間在 1 分鐘內完成。 多模型無伺服器端點適用於在單一端點上託管多個模型,但對於單一模型並非最佳選擇。非同步推論端點適用於大型有效負載或長時間執行的推論,但此處的資料量和推論時間相對較小。即時端點在閒置時擴展至 0 的自動擴展政策,雖然可以節省成本,但無伺服器端點在設計上更適合這種間歇性工作負載,且管理負擔更少。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡